在云端操作和自动缩放框时,会遇到某些监控问题。 有时我们可能会监视10个盒子,有时候是100个。机器会根据需求进行放大和缩小。 现在,我认为最好的解决scheme是select一个监视解决scheme,通过调用API实例化目标。 但是,这真的是最好的? 我喜欢dynamic发现的想法,但这也是云中的一个问题,因为看到目标不在同一个子网中。 什么监视解决scheme允许这样的扩展环境? Zabbix目前有一个API草案,但我一直无法为Nagios资助一个类似的API。 Nagios是否有类似的API? 除了Nagios和Zabbix,任何人都有其他build议吗?
我的一个客户build立了一个合stream/ JIRA系统。 他们遇到了一些问题 – 出站电子邮件被楔住,等等。如果你支持JIRA安装,你监视什么? 你使用JMX吗? 直接DB查询? 偶尔的SOAP请求到API? 我将使用Nagios / NRPE进行监控,但是会直接编写任何所需的支持脚本,所以任何运行在Linux机器上的技术都可能是好的。
我已经使用了Nagios一段时间了,最近开始使用Cacti后,不满足缩放和缺乏任何graphics用户界面的MRTG。 我有兴趣为Nagios安装添加趋势,并想知道最佳路线是什么。 我已经看了一下周围,看到了什么可用,但没有太多的信息来区分他们彼此。 我的Nagios安装有大约250个主机和1100个服务检查,但其中很多只是简单的networking设备,只有大约20个服务器和300个与之相关的服务。 除2之外的所有服务器都运行Windows Server 2003. PNP4Nagios与nagiosgraph的主要亮点是什么?或者,如果使用某种工具将数据转换为RRDforms并直接在Cacti中直接查看,那么最好是使用哪种工具? 有一个完全不同的方向,我可以去更好吗? 如果您需要更多信息,请发表评论,我倾向于太罗嗦,并试图保持这个问题简短。 谢谢!
我正在寻找串行端口监视的Wireshark。 我更喜欢免费/开源软件,但是如果价格合理,我愿意看看商业解决scheme。 它需要与Windows Vista / 7兼容,并将用于监视同一台计算机上两个COM端口之间的所有数据通信。
Nagios XI(这是Nagios的商业实现)可以根据阈值条件进行图表发送以及发送警报。 我无法理解Nagios和Cacti的区别。 任何想法之间的差异? 我宁愿不重复的努力。
我们使用Nagios来监视不less(〜130)台服务器。 我们监视每台服务器上的CPU,磁盘,RAM和其他一些东西。 我一直使用SSH来运行远程命令,纯粹是因为它在远程服务器上几乎不需要额外的configuration,只需安装nagios-plugins,创buildnagios用户并添加SSH密钥,所有这些都已经自动化一个shell脚本。 我从来没有考虑过使用SSH优于NRPE的性能影响。 我对Nagios服务器的负载没有太大的打扰(这可能是过度的,从来没有超过10%的CPU),但我们每30秒运行一次远程检查,每台服务器有5个不同的检查执行。 我认为SSH需要更多的资源为每个检查,但有一个巨大的差异? (IE足够的差异,保证切换到NRPE)。 如果有任何帮助,我们会监控混合使用物理服务器(通常包含8,12或16个物理内核)和Amazon EC2中/大型实例。
我用nginx和PostgresSQL通过Puppet( https://forge.puppetlabs.com/dwerder/graphite )安装了Graphite。 当我手动发送数据时,它会创build度量标准,但其所有数据点都是“无”(aka null)。 如果我运行Graphite附带的example-client.py,也会发生这种情况。 echo "jakub.test 42 $(date +%s)" | nc 0.0.0.0 2003 # Carbon listens at 2003 # A minute or so later: $ whisper-fetch.py –pretty /opt/graphite/storage/whisper/jakub/test.wsp | head -n1 Sun May 4 12:19:00 2014 None $ whisper-fetch.py –pretty /opt/graphite/storage/whisper/jakub/test.wsp | tail -n1 Mon May 5 12:09:00 2014 None $ whisper-fetch.py –pretty […]
所以过去几天我一直在玩石墨,我可以看到那里的潜力,为什么它如此强大。 我的主要问题是为什么我应该像esty那样使用statsd,还有很多其他人呢? 到目前为止,我还没有看到在石墨前面放置另一个叠层的好处。 我希望有人能清除它 https://github.com/etsy/statsd
大家好! 我正在寻找一些软件来监视我们的服务器的健康状况。 我们的环境是运行Microsoft Server和VMware vSphere的HP / Dell的典型组合。 我们目前正在使用WhatsUPGold,并希望从此迁移。 我一直在检查戴尔pipe理控制台和IT助理,但我认为让我们的所有产品都受到监控似乎很麻烦。 任何其他build议,将适用于中等规模的环境? 编辑:我也应该注意到,我想要一些相当简单的推出,不需要大量的规则/自定义规则创build/编辑。
如何使用Ubuntu 12.04监控HP Proliant服务器的硬盘和RAID的状态。 在Ubuntu 10.04中,我可以使用cciss-vol-status来定期查询RAID状态,但cciss-vol0-status在12.04版本中不起作用。 在12.04没有/ proc / driver / cciss或/ dev / cciss目录。