Articles of 监测

监控AWS EC2上的负载

我有兴趣监测我们的EC2实例,以确保在必要时扩大规模。 现在我们正在监视闲置的CPU时间作为我们的指标。 我们不测量磁盘I / O,因为我们不是一个非常密集的应用程序。 当我们在数据中心自己的硬件上运行时,我通常还会监视top命令中的“加载”。 我的问题是: 监控共享环境(如EC2)上的“负载”是否有意义? 如果是这样,你如何解释结果?

如何正确划分Icinga2中的主机?

我只是从Nagios迁移到Icinga2并有一个问题。 例如,我有一群主机相关的function,例如“networking”。 但是我想用不同的门槛来检查那个组的温度。 例如,对于主机1 60C是正常的,但对于主机2我想设置阈值不超过55C。 什么是组织主机的最佳策略,我应该做出像“web_low_temp”,“web_high_temp”等单独的组合,并绑定单独的检查命令为该组或者也许有人知道更好的解决scheme? ps我相当新与Icinga2请分享您的经验。

用标准MIB无法获得接口速度,使用highperf mib(-g)

我的团队每小时收到一封电子邮件,内容如下: Shinken Notification Notification Type: PROBLEM Service: NetworkUsage Host: Monitor Address: localhost State: UNKNOWN Date/Time: 27-09-2016 Additional Info : Cannot get interface speed with standard MIB, use highperf mib (-g) : UNKNOWN 我觉得我发现有问题的服务器(这是监控服务器,因为地址是localhost ),但我不知道该怎么做(我是一个开发人员,几乎对shinken,nagios或SNMP几乎一无所知) 。 我想我错过了一个应该能够提供某种highperf函数的MIB。 这是一个非常旧的服务器,我不知道在哪里可以find/如何安装这个MIB。 DISTRIB_ID=Ubuntu DISTRIB_RELEASE=12.04 DISTRIB_CODENAME=precise DISTRIB_DESCRIPTION="Ubuntu 12.04.5 LTS" 我怎样才能提供这种方法? 或者,我怎样才能禁用这个特定的主机检查?

collectd中的MBean参数是什么意思?

我正在使用JMX通过collectd的GenericJMX插件监视Apache Kafka集群。 但是,我不确定一些MBean参数是什么意思。 特别是,我有一个名为kafka.server:type=BrokerTopicMetrics,name=MessagesInPerSec指标kafka.server:type=BrokerTopicMetrics,name=MessagesInPerSec ,显示一台机器每秒收到的消息数量。 这是这个MBean的configuration文件: <MBean "kafka-all-messages"> ObjectName "kafka.server:type=BrokerTopicMetrics,name=MessagesInPerSec" InstancePrefix "all" <Value> InstancePrefix "kafka-messages-in" Type "counter" Table false Attribute "MeanRate" </Value> </MBean> 我不知道哪种Type的测量是正确的,例如gauge , counter或其他types。 我已经尝试阅读收集的这个文件,不能真正了解我应该在哪里应用每种测量types。 有人能解释我吗?

简单的自主网站监控

我正在寻找一个简单的自我托pipe的网站监测工具。 它应该是类似于watchmouse.com或pimgdom.com,有一个很好的用户界面,丰富多彩的图表等(客户喜欢:))。 目前我们也使用Zabbix进行HTTP监控,但是现在我们的主机直接关心机器上的硬件和软件监控,我们不再需要Zabbix了。 对于纯粹的http监控zabbix或其他监控套件确实是一个矫枉过正的事情。 所以我不在寻找的是: Zabbix Nagios Hyperic ….不幸的是,事实上,经过几个小时的研究,我无法find合适的应用程序。 我的希望现在在你身上。 提前致谢。

在仙人掌的两个图表之间可能显示差异吗?

我有许多graphics(界面统计)的仙人掌,我需要显示他们两个之间的差异。 就像traffic = traffic1-traffic2其中traffic1和traffic2是两个独立交换机上的接口。 可能吗?

我应该如何监视SunOS / Solaris中的内存使用情况/性能?

上周,我们决定在我们正在运行的munin实例中添加一些SunOS( uname -a = SunOS bbs-sam-belair 5.10 Generic_127128-11 i86pc i386 i86pc )机器。 首先,这些机器是预先configuration的设备,所以,我想避免在没有服务提供商的监督的情况下触摸系统太多。 但是通过编写一个小的套接字服务将它添加到munin是相当容易的(如果有人感兴趣,我把它放在github上: https : //github.com/munin-monitoring/contrib/tree/master/tools/pypmmn ) 昨天,我执行/改编了我们机器所需的插件。 这里的问题开始: 首先,我还没有find确定详细的内存使用价值的方法。 我通过运行prtconf | grep Memory获得总内存 prtconf | grep Memory ,以及使用vmstat的可用内存。 一起popup一个munin-plugin,给了我下面的图表: 这是非常不明智的。 把这个与linux节点的默认插件相比,这个插件有更多的细节: 最重要的是,这显示了应用程序实际使用了多less内存。 所以,第一个问题:是否有可能获得有关SunOS的默认系统工具 (即不使用top )的详细内存信息? 进入下一个难题:查看图表,我注意到“Paging in / out”图表中的活动, 即使内存图表仍有未使用的内存 : 经过进一步的调查,我发现df报告/tmp被挂载在swap 。 在网上浏览,我明白, df将显示swap ,但实际上,它被挂载为一个tmpfs 。 现在我不知道这是否解释了交换活动。 solaris默认的munin-plugin使用kstat -p -c misc -m […]

如何监视Windows文件夹中文件的大小?

有什么方法可以自动监控目录中的文件大小,并在Windows服务器上接近某个限制时发送警告电子邮件? 我有一个进度数据库安装进行检查,上周我们遇到了一些问题。 显然,范围的size of extents已经达到了2GB,而且Progress不会超过这个范围,所以我们需要打开一个新的范围。 我来自Linux环境,所以我不知道通常在Windows环境(或任何监控工具)中监测这个情况。 我更喜欢一些通用的解决scheme,因为我有一个混合环境(Windows 2000,Windows Server 2003,Windows Server 2008 R2)。 在此先感谢所有可用的替代答案。

我怎样才能通过API发送短信

如何发送国际短信(或拨打电话)与HTTPS请求? 你知道/使用哪些可靠的服务提供商? 我想使用SMS服务而不是硬件方法。

拉服务器统计远程监控

我想写我自己的服务器监控应用程序。 理想情况下,它可以显示统计信息,如负载,正常运行时间,CPU活动,最活跃的进程,内存使用情况等。从服务器获取信息的最佳方法是什么? 我最初想到的是运行ssh -e命令,但是想查看是否有比查询服务器更高效的方法。 或者,最好是将数据与Munin或类似的监测工具进行汇总? UPDATE 为了更清楚起见,我主要感兴趣的是从服务器获取上述各种数据的最佳方式,以便我可以将其呈现在我有兴趣构build的Android应用中。 在服务器上写实际的探测器本身并不是我想要做的工作,这就是为什么我希望Nagios或类似的东西可能已经提供了数据寻找。 我只需要将这些数据提取出来并在我自己的工具中进行渲染即可。