Articles of 监测

如何使用nagios监视Zookeeper节点

对不起,这可能是一个基本的问题,但我对nagios和动物园pipe理员都是新手。 我的公司有一个应用程序,使用zookeeper通过创build/销毁节点来跟踪作业状态。 我需要能够监视节点的数量总是2 *工人的数量或更less,是否有插件,可以做到这一点已经为nagios? 如果是这样,那么我将如何configuration它呢? 谢谢,

Wireshark和镜像端口每秒带来10k +数据包

我在监控机器上安装wireshark来监控我们的办公室互联网stream量(约40台机器)。 但是,每当我在约30-40秒内启动wireshark时,它已经崩溃 – 我认为由于大量的数据包被接收大约每秒10,000+。 有没有解决这个问题? 我试图使用屏幕顶部附近的filter选项,但我仍然必须启用监视,并在那个时候太多的数据传递给计算机来应付…我想!

为什么在RAID 1下的一对磁盘温度会出现较大的温差?

对我来说,看起来很奇怪,从一个磁盘的SMART得到的温度读数不同于其在RAID 1configuration中的两倍高达9°C : # smartctl -d scsi -A /dev/sg1 === START OF READ SMART DATA SECTION === Current Drive Temperature: 34 C Drive Trip Temperature: 68 C # smartctl -d scsi -A /dev/sg2 === START OF READ SMART DATA SECTION === Current Drive Temperature: 43 C Drive Trip Temperature: 68 C 服务器是1U戴尔PowerEdge R210的规格在这里 。 可能是这种exception的原因是什么?

Coldfusion服务器监控:选项和意见

我公司的ColdFusion服务器版本没有附带服务器监视器。 由于我们的网站存在一些问题,我们认为这可能与服务器问题有关,所以我们正在考虑购买ColdFusion服务器监视器。 那里有什么select? 什么是不同的select的利弊? 任何信息表示赞赏!

智能手机应用程序在收到特定电子邮件时发出警报

这可能是服务器故障的边界,所以我很酷,如果这是决定这个问题迁移到其他地方。 作为一个系统pipe理员,我负责响应任何在几小时内发生的监控警报。 我有一个公司的问题黑莓,所以如果发送监测警报,我可以通知。 这很好..只要我不在另一个房间或睡着了。 是的,收到电子邮件时会发出噪音,但如果我错过了持续约2秒的小噪音,我已经错过了警报。 我正在寻找的是一个应用程序(支付是不是一个问题),当收到一个符合某些标准, 不会停止,直到我解雇它的电子邮件时,可以发出警报。 标准将是以下任何一项(如果我可以混合和匹配标准,奖励点数) 发件人地址 信息主题 收件人 这主要是为黑莓手机,但其他智能手机的应用程序可能会有利于更大的社区。

存档和可视化amazon ec2 cloudwatch指标

你如何备份ec2的cloudwatch指标? 你如何以不同的尺度同时显示不同的测量结果,如cpu%和i / o? 如何将您的应用程序服务器指标(如“每小时查看产品”)与cloudwatch指标(每小时cpu)结合起来? 我首先考虑在s3中存储原始的cloudwatch指标,然后使用munin进行可视化。 但也许有更先进的方法比慕宁的静态图像更具交互性。 干杯, 一月

ipmitool传感器:不检测备用电源

为什么不ipmitool检测我的第二个电源? 我有2个powersupplies插入我的机器,但调用ipmitool传感器只显示PS1: :~$ sudo ipmitool sensor |grep PS PS1 Status | 0x1 | discrete | 0x0b00| na | na | na | na | na | na 拔出PS1并重新运行该命令可以: :~$ sudo ipmitool sensor |grep PS PS1 Status | 0xb | discrete | 0x0b00| na | na | na | na | na | na 所以我知道ipmitool正在检测第一个powersupply状态,而第二个powersupply实际上是插入和工作的(因为0xB意味着PS1已经失败,但机器仍在运行) 我在多个单位看到这个问题,这些机器是: […]

Zabbix不发送电子邮件

我正在尝试使用电子邮件通知configurationzabbix。 我已经阅读了很多关于它的文档,但是我仍然错过了一些东西,因为它不工作。 我现在configuration的是: 媒体types:电子邮件,其中host = localhost ,helo = localhost ,email = [email protected] 除了“未分类”以外的所有事件的电子邮件用户 sendmail正在主机上运行 一个远程主机通过zabbix_agent进行监控 – 我将其closures以触发一个触发器 zabbix面板发出“嘟嘟”声,并正确显示失败的检查 没有任何东西写入sendmail日志(如果我尝试使用telnet连接,它会写入一个消息,所以它一般工作) 似乎没有任何相关的信息被写入zabbix_server日志 我还能检查什么?

如何在Ganglia上设置警报?

如何设置Ganglia,以便在群集中的某台计算机正在使用的情况下收到电子邮件,例如物理RAM的95%以上?

使用Open Monitoring Distro(OMD)自动监控新的云服务器?

我花了一些时间来使用Nagios,Check_mk和一些其他非常有用的工具,作为OMD包的一部分。 一旦手动安装了check_mk代理,WATO特别适用于通过GUI来pipe理所有静态的基于Windows和Linux的服务器。 我想问问什么是使整个监控stream程自动化的最佳方式? 或者即使可以做到? 我们将使用厨师食谱来定期提供新的服务器,并频繁地closures其他服务器。 如果我们要继续使用Nagios / Check_mk,那么为了追踪和监控我们的基础设施,pipe理员的工作量是非常重要的。 非常感谢您的帮助。 史蒂夫