Articles of Nagios

可以configurationNagios根据特定主机组中的特定比例的服务发送通知吗?

比方说,我们有一个由100个主机组成的主机组,所有这些主机都被监视服务X.假设这个服务在所有主机上都被closures了。 而不是接收100个单独的警报,我想收到一个单一的警报,说“服务X是closures整个主机组”或什么的。 Nagios可能吗? 如何实现它? 我在网上查看,但没有看到这个特殊情况的讨论。 编辑:请注意,这不是一个面向networking的服务,这是在每个主机上完成本地检查。 具体来说,检查本地SSL证书是否过期。

check_cluster参数不被parsing

试图在大型(〜80节点)集群上创build一个http服务检查的集群检查。 我希望它在非正常状态下警告40多个节点,在非正常状态下暴击60多个节点。 命令定义是: define command { command_name check_cluster command_line $USER1$/check_cluster –service -l $ARG1$ -w $ARG2$ -c $ARG3$ -d $ARG4$ } 服务定义是: define service { name Laborer Clutser check service_description laborer_cluster hostgroup_name laborer_cluster use generic-http-1min check_command check_cluster!@40!@60!"laborer cluster"!$SERVICESTATEID:cs01:laborer-http$,$SERVICESTATEID:cs02:laborer-http$,$SERVICESTATEID:cs03:laborer-http$,..$SERVICESTATEID:csNN:laborer-http$ 但由于某种原因,只有一个主机处于非正常状态,它会发生WARN: 警告一个不好的

CHECK_NRPE:错误 – 无法完成SSL握手。 win2003server

win2003k与nsclinet ++(远程主机)0.4.4.19和ubuntu 16服务器(监控主机)。 我的nsclient.ini [/settings/default] allowed hosts = 127.0.0.1,::1,10.50.133.98 password = 12345 port=5666 ; Undocumented section [/settings/NRPE/server] allow_arguments=1 allowed ciphers=ALL:!ADH:!LOW:!EXP:!MD5:@STRENGTH verify mode = peer-cert insecure = true [/modules] CheckExternalScripts = 1 CheckHelpers = 1 CheckEventLog = 1 CheckNSCP = 1 CheckDisk = 1 CheckSystem = 1 NRPEServer = 1 从10.50.133.198主机我发: check_nrpe -H 10.50.133.100 我有: **CHECK_NRPE: […]

SNMPTT exec不起作用

我们在Nagios环境中使用SNMPTT。 我的MIB适用于所有事件,但是1.我无法弄清楚发生了什么。 当陷阱进来时,我希望它执行一个文件,然后处理通知和Nagios警报。 以下是MIB的部分: EVENT lgpEventConditionEntryAdded .1.3.6.1.4.1.476.1.42.3.3.0.1 "Status Events" CRITICAL FORMAT LIEBERT CUSTOM TRAP lgpEventConditionEntryAdded EXEC /usr/lib64/nagios/plugins/pob_translate_liebert_trap.sh $r $s $2 SDESC The device is reporting an alarm. EDESC 我的pob_translate_liebert_trap.sh文件只是额外的电子邮件debugging,然后将其发送到Nagios。 这里没有什么可看的。 这是snmptt.debug日志的结果,当一个陷阱匹配时.1.3.6.1.4.1.476.1.42.3.3.0.1 Processing file: #snmptt-trap-1468519738245030 Reading trap. Current time: Thu Jul 14 14:32:38 2016 Raw trap passed from snmptrapd: 1468519738 <UNKNOWN> UDP: [10.redacted]:65534->[170.redacted] .1.3.6.1.2.1.1.3.0 70:4:13:32.08 .1.3.6.1.6.3.1.1.4.1.0 […]

NRDS是否与Nagios Core兼容?

我有(inheritance)一个Nagios核心服务器v 3.5.1。 (我们用来监视我们自己的服务器,通过大多数nrpe和一些check_nt的窗口)。 我收到了我们的一个客户的要求,通过我们的nagios监视他的一台机器。 客户说他期望得到“ url,令牌和configuration文件 ”。 一个快速的谷歌透露,有一个相对较新的NRDS“方法” – 我不知道 – 这只需要这三件事情的客户端configuration。 我花了一些时间试图谷歌方法如何连接和设置与NRDS_win客户端的Nagios核心(不Nagios XI)。 它甚至是可能的吗? 我见过的所有教程都提到NRDSconfigurationpipe理器,它安装在Nagios XI中,没有提到Nagios核心。

被动检查不更新nagios网站

被动检查的定义似乎得到纠正。 我设置了一个cron作业,每5分钟运行一次,然后执行脚本,输出处理使用: command_file=/var/spool/nagios/cmd/nagios.cmd [timestamp] PROCESS_SERVICE_CHECK_RESULT;host_name;svc_description;return_code;plugin_output >> $command_file 这些事情得到证实: check_external_command=1 accept_passive_service_checks=1 passive_checks_enabled已设置 Check_dummy定义像例子一样定义 define command{ command_name no-backup-report command_line /usr/local/nagios/libexec/check_dummy 3 $ARG1$ } 等等 完成提交和更新后,文件安装和nagios重新启动,不会生成错误,但是,检查不会使用适当的信息更新nagios站点。 这是第一次设置被动检查,所以任何input将不胜感激。

没有输出从插件返回,但服务显示确定

我试图通过使用check_memory.pl和下面的命令设置来检查系统内存: 在远程主机上的nrpe.cfg中 command[check_mem]=/usr/lib/nagios/plugins/check_mem -f -w 20 -c 10 Nagios服务器上的服务: define service{ use generic-service host_name Hostname ;winserver service_description Check Memory check_command check_nrpe!check_mem } 当我在这样的远程主机上运行命令 /usr/lib/nagios/plugins/check_mem -f -w 20 -c 10 我得到: OK – 73.6% (6013416 kB) free.|TOTAL=8175616KB;;;; USED=2162200KB;6540492;7358054;; FREE=6013416KB;;;; CACHES=2021812KB;;;; 当我跑步 /usr/local/nagios/libexec/check_nrpe -H host-ip -c check_mem or /usr/local/nagios/libexec/check_nrpe -H host-ip -c check_mem -a -w 20 -c […]

偶尔或频繁CHECK_NRPE:错误 – 无法完成SSL握手

我的Nagios / NRPE已经按照预期进行了几年configuration和工作。 偶尔或有时甚至在一天中我经常“CHECK_NRPE:错误 – 无法完成SSL握手”。 有没有办法忽略这个错误,因为Nagios开始发送警报只是为了恢复下一分钟。

在Ubuntu服务器上获取Nagios与在WAN上的Windows服务器上运行的NSClient ++对话

我已经在Windows机器上安装了freeSSHD,创build了一个用户,启用了隧道,通过一个公共rsa密钥复制,并安装了NSClient ++。 在我的Nagios服务器上,我有Nagios运行和一个Windows.cfg文件,看起来是正确的。 我能够从nagios框ssh到以下窗口框: ssh user @ windows-box-ipaddr 和 ssh -f -N -L 127.0.0.1:1433:windows-box-ipaddr:1433 administrator @ windows-box-ipaddr 尽pipe如此,我在Nagios中看到这样的错误: 连接到地址127.0.0.1和端口12489:连接被拒绝 我不知道什么IP地址需要在定义主机的windows.cfg去,我也不知道什么NSClient ++ IP应该设置。 我确实知道的是,我可以通过SSH连接这台服务器。 我想我应该使用另一个端口,或者也许我需要在防火墙中打开许多端口。 在这一点上,我处于停滞状态。

Nagios插件CHECK_NRPE接收标题下溢

我在局域网上运行Nagios Core服务器。 我在networking外部有5台Windows机器,通过5个不同端口上的5个ssh隧道来监听5个自定义NSClient ++应用程序。 所有的这个configuration都运行良好,但是我注意到check_nt MEMUSE给了我们奇数,实际上我们所需要的只是实际的物理内存。 经过多次挖掘,我发现了check_nrpe,看起来它会给我我正在寻找的数据。 我把下面的命令放在commands.cfg中: define command { command_name CheckWindowsPhysicalMem command_line $USER1$/check_nrpe -H $HOSTADDRESS$ -p 5666 -c CheckMEM -a MaxWarn=$ARG1$% MaxCrit=$ARG2$% ShowAll=long type=physical } 我把以下内容放在我的windows.cfg中 define service{ use generic-service host_name HOSTNAME service_description Physical Memory check_command CheckWindowsPhysicalMem!80!90 } 我重新启动了nagios和nagios-nrpe-server,现在我得到这个错误: CHECK_NRPE: Receive header underflow – only 0 bytes received (4 expected) 我不知道我在这里错过了什么,但如果看起来像一个依赖或一个包。 谷歌 – […]