Icinga2通过NRPE监控同一局域网中的几台虚拟机。 [机器A] CentOS 6 Icinga2。 [机器B] CentOS 6 MariaDB v10.1.12正常运行 Datatir和套接字设置在my.cnf中: datadir=/database/mariadb socket=/database/mariadb/mysql.sock 还有以下符号链接: /var/lib/mysql -> /database/mariadb 所有者:上面所有的组是mysql:mysql。 启用SELinux / usr / lib64 / nagios / plugins / check_mysql v2.0.3 具有以下安全上下文: -rwxr-xr-x. root root system_u:object_r:nagios_services_plugin_exec_t:s0 /usr/lib64/nagios/plugins/check_mysql nrpe.cfg包含以下行: command[check_mysql]=/usr/lib64/nagios/plugins/check_mysql -H localhost -u xxx -p xxx -P 3306 现在的问题是: Icinga(来自机器A)报告: "Can't connect to local MySQL server through […]
我在新服务器上安装了nrpe。 Nagios已经在运行并检查其他服务器(我还没有安装)。 我的系统日志文件中有几个错误行: Oct 31 15:17:01 myservername nrpe[41848]: Host nagios_ip is not allowed to talk to us! 我的nrpe.cfg文件包含以下行: allowed_hosts=nagios_ip 我究竟做错了什么 ? (与nagios_ip我的nagios服务器的实际IP)
我试图从NRPE使用check_procs找出Passenger是否在我的服务器上运行。 它从httpd加载,但单独出现。 32135 ? Sl 0:09 Passenger RackApp: /usr/share/puppet/rack/puppetmasterd 32589 ? Sl 0:01 Passenger AppPreloader: /usr/share/puppet/rack/puppetmasterd 32629 ? Sl 0:05 Passenger RackApp: /usr/share/puppet/rack/puppetmasterd 32751 ? Sl 0:05 Passenger RackApp: /usr/share/puppet/rack/puppetmasterd 当我尝试像这样testing它时: check_procs -w 2: -c 3: -C Passenger 它告诉我find了0个进程。 我看到他们 – 我怎么得到NRPE数呢?
我试图从NRPE.cfg运行Powershell脚本,并在Nagios中获得输出。 当我在本地(Windows)服务器上运行脚本时,一切都很好。 但是,当我把它放在NRPE.cfg EN尝试获得输出在Nagios,我得到一个无法读取输出错误。 search互联网,但无法find解决scheme,所以也许你可以帮助我.. 命令/脚本是: 命令[check_veeam_dailyone] = cmd / c echo c:\ install \ veeam_check.ps1; 退出($ lastexitcode)| powershell.exe -ExecutionPolicy绕过-noninteractive -noprofile -File – 当我把这个在PowerShell的Windows服务器上,我会得到这个输出: PS C:\ Install> OK – 工作:VeeamOne_Daily在10/09/2014 04:45:51成功完成。 “PS C:\ Install>”部分很奇怪,但它确实读取了上一份工作,所以看起来“没问题”。 但是当我尝试在Nagios中获得这个输出时: root @ nagios:〜#/ usr / lib / nagios / plugins / check_nrpe -H 192.168.1.1 -t 300 -c check_veeam_dailyone 它说: NRPE:无法读取输出 […]
我曾经在Nagios中使用过这两个参数(first_notification_delay,notification_interval),直到现在为我完美工作。 现在我已经添加了使用nrpe命令的新检查。 上述两个参数不受影响。 我每隔十分钟就会收到一封电子邮件。 我必须改变主机nsclinet.cfg文件上的任何东西吗? 我正在使用的服务定义是 define service { use generic-win-logfile host_name RuleS_TI_E405,RuleS_TI_E464 service_description check_logfilesSmsDispatcher_Process check_command check_nrpe!check_logfilesSmsDispatcher_Process } 它embedded了以下服务模板: define service{ name generic-win-logfile active_checks_enabled 1 passive_checks_enabled 0 parallelize_check 1 obsess_over_service 1 check_freshness 0 notifications_enabled 1 event_handler_enabled 1 process_perf_data 0 retain_status_information 1 retain_nonstatus_information 1 is_volatile 1 check_period 24×7 max_check_attempts 3 normal_check_interval 10 ; check every 5 […]
我正在使用NSCLient在Windows Server框上运行一些NRPE检查。 检查运行Powershell脚本,但我遇到的问题是NSClient 79个字符后添加随机换行符。 我猜这是因为默认的Powershell / CMD控制台宽度是80个字符(这是正确的?),但我需要检查不添加这些新行(他们搞砸了性能数据和Nagios得不安)。 我试过从一个标准的Powershell实例改变控制台的大小,但没有奏效,有什么办法用命令行标志指定控制台的大小? 帮助文件没有多大用处。 我从Nagios的check_nrpe得到的输出的一个例子 vmxnet3 ethernet adapter _2:728.370961294234isatap.{1c6435bc-27c9-452b-a6fe-668^M dced31461}:0| 'Network Usage (Bytes/sec) (vmxnet3 ethernet adapter _2)'=728.370^M 961294234 'Network Usage (Bytes/sec) (isatap.{1c6435bc-27c9-452b-a6fe-668dced31^M 461})'=0 (问题不在于控制字符,Nagios似乎没有注意到它们,但是新的线路本身) Powershell脚本; # # Check Network Usage # #Check for argument variables if ( $($args.count) -lt 2 ) { "Usage: ./check_network.ps1 [warn level] [crit level]" exit 3 […]
我正在使用插件,它给了我警告或crtisbuild立连接。 如果我在本地机器上运行,它会给出: *root@graber:/usr/lib/nagios/plugins# ./check_connections -w 1 -c 5 -C sshd CRITICAL Established connections: 6* 我知道,我以root身份运行。 但: 文件的权利: root@graber:/usr/lib/nagios/plugins# ls -all check_connections -rwxr-xr-x 1 nagios nagios 5459 2012-07-06 10:19 check_connections 的/ etc / sudoers中: root@graber:/usr/lib/nagios/plugins# cat /etc/sudoers Defaults env_reset root ALL=(ALL:ALL) ALL %admin ALL=(ALL) ALL nagios ALL=(ALL) NOPASSWD: /usr/bin/lsof nagios ALL=(ALL) NOPASSWD: /usr/lib/nagios/plugins/ /etc/nagios/nrpe.cfg: *nrpe_user=nagios nrpe_group=nagios* […]
我试图通过Icinga2 check_nrpe插件监视虚拟服务器上的一个小型服务。 我已经正确设置,因为我可以做到以下几点: 当我从主服务器运行/usr/lib/nagios/plugins/check_nrpe -H remote-server-ip ,我得到NRPE v2.15 当我从远程服务器执行/usr/lib/nagios/plugins/check_nrpe -H main-server-ip ,我得到了相同的结果。 当我运行/usr/lib/nagios/plugins/check_nrpe -H remote-server-ip -c check_load我得到WARNING – load average: 5.85, 5.67, 5.55|load1=5.850;15.000;30.000;0; load5=5.670;10.000;25.000;0; load15=5.550;5.000;20.000;0; WARNING – load average: 5.85, 5.67, 5.55|load1=5.850;15.000;30.000;0; load5=5.670;10.000;25.000;0; load15=5.550;5.000;20.000;0; 现在我正在尝试使用check_nrpe在远程计算机上运行一个放在/usr/local/lib/ check_remote_server.py的小脚本。 为此我做了以下几点: 在/etc/icinga2/conf.d/test.conf object Service "Test Check" { import "generic-service" host_name = "remote-server-ip" check_command = "check_nrpe" vars.ARG1 = "check_remote_server" } […]
我正在尝试configurationNagios以监视FreeSWITCH,如https://github.com/kjhosein/nagios-freeswitch-plugin中所述 。 我已经从git下载脚本,并按照列出的步骤。 在远程(NRPE)服务器上,我在nrpe.cfg文件的下面添加了一行 command[check_freeswitch_health]=/usr/lib64/nagios/plugins/check_freeswitch_health.pl $ARG1$ 在Nagios服务器上,添加在commands.cfg文件中 define command { command_name check_freeswitch_health command_line $USER1$/check_nrpe -H $HOSTADDRESS$ -c check_freeswitch_health $ARG1$ } 并在services.cfg文件中 define service { host_name freeswitch01 service_description FreeSWITCH – Calls Count check_command check_freeswitch_health!-a '-q show-calls-count'!!!!!!! } 但是,在Nagios的web界面我越来越 CHECK_NRPE: Received 0 bytes from daemon. Check the remote server logs for error messages. 在远程服务器上,显示以下错误的日志(/ var / log […]
我为nagios设置了以下服务: define service { hostgroup_name LNX service_description /tmp Disk Usage check_command check_nrpe!check_disk!-a '-w 20% -c 10% -p /tmp' check_interval 1 max_check_attempts 3 retry_interval 1 check_period 24×7 notification_interval 2 notification_period 24×7 notification_options c,r,w notifications_enabled 0 contact_groups devops } 与以下命令关联的是: define command { command_name check_nrpe command_line $USER1$/check_nrpe -H $HOSTADDRESS$ -u -t 60 -c $ARG1$ $ARG2$ } 所以最后执行的是什么(在命令行上运行时的输出)是: […]