Articles of nrpe

check_nrpe和不固定的计数器名称

对于一些计数器,我已经注意到Windows convently确实为它们提供了一个稳定的名称,例如: \.NET Data Provider for SqlServer(_lm_w3svc_3_root-1-123412341234[6789]\Number of Free Conections 天知道1234是什么,6789是PID。 这些计数器也不呈现任何types的_Total实例。 通常我使用Nagios的check_nrpe来监控perfmon计数器,但我不知道如何使用这些有dynamic名称的工作 – 任何想法?

NSClient ++中的命令“CheckFileSize”没有处理程序

我试图通过使用NSClient ++(0.4.0.148-win64)通过NRPE从Linux的一个窗口监视Windows服务器上的文件夹的大小。 基本的设置是可以的,例如我能够发出“CheckDriveSize”命令,该命令是与“CheckFileSize”相同的“CheckDisk” – 模块的一部分。 问题是,当我尝试执行“CheckFileSize”我得到一个“BAD_CODE:-1”NSClient + +错误。 我尝试的命令基本上来自手册( http://www.nsclient.org/nscp/wiki/CheckFileSize ): ./check_nrpe -H windowsserver -p 5666 -n -c CheckFileSize -a ShowAll MaxWarn=1024M MaxCrit=4096M File:_WIN=c:/WINDOWS/*.* 我得到的日志输出是这样的: trunk\include\nrpe\server\connection.cpp:37 starting data connection runk\modules\NRPEServer\handler_impl.cpp:34 Running command: CheckFileSize ..\..\..\trunk\service\NSClient++.cpp:1128 Injecting: checkfilesize… ..\..\..\trunk\service\NSClient++.cpp:1152 Result checkfilesize: BAD_CODE: -1 k\include\nscapi\nscapi_core_wrapper.cpp:181 No handler for command 'CheckFileSize'. runk\modules\NRPEServer\handler_impl.cpp:36 Running command: CheckFileSize = trunk\include\nrpe\server\connection.cpp:106 Wrote data: […]

Nagios / NRPE如何检查下面安装的所有文件系统

我在/ opt / virt / img下有多个安装点,每个安装点都是一个用ext4格式化的LVM逻辑卷,包含正在运行的虚拟机的qcow2磁盘映像。 我想知道这些卷何时被填满。 是否有一些types的check_disk通配符我可以用来保存我不必指定每个? CentOS 6.3 NRPE 2.13

被监控机器上的check_nrpe套接字超时

在新的开发机器上设置nrpe监视时,我遇到了一些麻烦。 我已经遵循了我所能find的所有推荐步骤,但依然无济于事。 执行/usr/lib/nagios/plugins/check_nrpe -H localhost -n导致套接字超时,无论使用-t指定的时间如何。 netstat -latnp | grep 5666 results in: tcp 0 0 0.0.0.0:5666 0.0.0.0:* LISTEN 26718/nrpe 我正在使用12.04 LTS。 任何想法将不胜感激。

nagios检查在nagios主机上失败,但在本地工作

我写了一个小的bash脚本来和nagios一起使用来检查nrpe是否在运行。 以root身份运行时检查在本地运行,但在监视主机上运行失败。 从我试图监视的主机,我在我的nrpe.conf中有这行: command[check_nrpe]=/usr/lib64/nagios/plugins/check_nrpe.sh 并确保检查脚本是由nagios用户拥有的: [root@ops:~] #ls -l /usr/lib64/nagios/plugins/check_nrpe.sh -rwxr-xr-x. 1 **nagios nagios** 203 Jun 9 20:29 **/usr/lib64/nagios/plugins/check_nrpe.sh** 如果我以root用户身份运行脚本,我会得到正确的结果: [root@ops:~] #/usr/lib64/nagios/plugins/check_nrpe.sh OK: NRPE is running with pid: 24538 24538 但是当我从nagios主机运行它时,检查产生相反的结果: [root@monitor1:~] #/usr/local/nagios/libexec/check_nrpe -H ops.mydomain.com -c check_nrpe **CRITICAL: NRPE is **NOT** Running** 如果我回到主机,我试图监视并成为nagios用户,我得到的结果与我在nagios主机上的结果是一样的。 [root@ops:~] #su – nagios Last login: Tue Jun 9 20:43:42 UTC 2015 on […]

UNKNOWN:没有该命令的处理程序

我将check_task.vbs放置在Windows Server 2008 R2上的C:\ nsclient ++ \ scripts中。 我在NSC.ini中定义了一个这样的NRPE处理程序: [NRPE Handlers] check_task=cscript.exe //NoLogo scripts\check_task.vbs $ARG1$ $ARG2$ 在commands.cfg中,命令是这样定义的: define command{ command_name check_task command line $USER1$/check_nrpe -H $HOSTADRESS$ -c check_task -a $ARG1$ $ARG2$ } 当我在/ usr / local / nagios / libexec中运行以下代码时,它以“UNKNOWN:No handler for the command” ./check_nrpe -h Server01 -c check_task 我错过了什么?

NSCA被动陈旧 – >多个挂nrpe进程?

shinken 2.0.3 nrpe 2.15 我们使用nsca来执行被动检查。 define service { name salt-service register 0 active_checks_enabled 0 passive_checks_enabled 1 check_freshness 1 freshness_threshold 600 max_check_attempts 2 check_interval 5 retry_interval 3 } define service { use salt-service service_description syncthing_procs-2 host_name x check_command check_nrpe!syncthing_procs!10 display_name Syncthing Procs } 虽然freshness_threshold是10分钟,但是被动检查是陈旧的情况: Oct 6 09:52:36 x shinken:[Tue Oct 6 09:52:35 2015]警告:主机'x'上服务'syncthing_procs-2'的结果是陈旧的0d 0h 10m 16s(threshold […]

NRPE从命令行工作; 来自Nagios的“不正确的命令行参数”

我试图设置一个基本的例子NRPE作为第一步部署它。 为了简单起见,我在本地运行NRPE和Nagios。 NRPE和Nagios似乎都在工作,但从Nagios使用check_nrpe神秘地失败。 编辑:我使用Nagios的4.1.1版和NRPE的2.15版。 我认为NRPE正在工作,因为我可以手动运行check_nrpe: /s/l/n/nagios_instance ❯❯❯ libexec/check_nrpe -H 127.0.0.1 -p 5667 -c check_total_procs ⏎ PROCS CRITICAL: 536 processes | procs=536;150;200;0; 我认为Nagios正在工作(并提供正确的参数),因为我已经在python中写了这个简单的检查,名为check_hello_world.py的文件位于libexec目录中: #!/usr/bin/env python import sys print str(sys.argv) raise SystemExit, 2 我的nagiosconfiguration的相关行如下所示: define host { use linux-server host_name yourhost alias My first Apache server address 127.0.0.1 } define command { command_name check_procs_nrpe command_line $USER1$/check_hello_world.py –H […]

没有输出从插件返回,但服务显示确定

我试图通过使用check_memory.pl和下面的命令设置来检查系统内存: 在远程主机上的nrpe.cfg中 command[check_mem]=/usr/lib/nagios/plugins/check_mem -f -w 20 -c 10 Nagios服务器上的服务: define service{ use generic-service host_name Hostname ;winserver service_description Check Memory check_command check_nrpe!check_mem } 当我在这样的远程主机上运行命令 /usr/lib/nagios/plugins/check_mem -f -w 20 -c 10 我得到: OK – 73.6% (6013416 kB) free.|TOTAL=8175616KB;;;; USED=2162200KB;6540492;7358054;; FREE=6013416KB;;;; CACHES=2021812KB;;;; 当我跑步 /usr/local/nagios/libexec/check_nrpe -H host-ip -c check_mem or /usr/local/nagios/libexec/check_nrpe -H host-ip -c check_mem -a -w 20 -c […]

偶尔或频繁CHECK_NRPE:错误 – 无法完成SSL握手

我的Nagios / NRPE已经按照预期进行了几年configuration和工作。 偶尔或有时甚至在一天中我经常“CHECK_NRPE:错误 – 无法完成SSL握手”。 有没有办法忽略这个错误,因为Nagios开始发送警报只是为了恢复下一分钟。