我目前正在开发一个关键任务的项目。 实际域名注册1&1,我计划购买DynDNS自定义DNS服务(其中有5个不同的地理位置的DNS),然后另一个辅助DNS服务,以确保我的DNS尽可能安全的故障转移。 注册是否与1&1有关系吗?它们是链条中的薄弱环节吗? 所有我真正使用它们是说,DynDNS是我的主DNS名称服务器,然后我的第二个DNS是我的另一个名称服务器。 我可以将注册转移到DynDNS – 我只是不知道它是否真的很重要。 谢谢
通常情况下,对于“正常”情景,在给定的月份中,对于服务级别协议(SLA)正常运行的期望是什么? 我包括了我的期望…这个问题的目的是要找出2009年在IT基础架构中设定SLA目标的标准基准。 (同样,在一个正常的情况下 – 我们不是在说亚马逊或Google,但是我们再也没有谈论比利鲍勃的网站在家里的DSL上托pipe)。 电力(100%) networking/核心路由/交换(99.999%) 静态文件托pipe(99.99%) 应用程序托pipe[单一服务器/数据库](99.95%) 电子邮件主机(99.95%) 复杂的应用托pipe/平台[多服务器/数据库/服务](99.9%) (供参考… SLA计算器 ) 最后… 一个月内可以接受多less维修时间?
我们有四台服务器用于任务关键型应用程序,这些应用程序都需要相互连接,总共有六个始终连接的连接。 我需要一种方法来监视这些连接,并且至less在任何一个连接断开时发送电子邮件。 我可以find集中的解决scheme,但没有什么真正符合这个法案。 有什么build议么? 编辑:走在前面,在Ruby中推出自己的。 Nagios看起来像是一个不错的套件,不过 – 否则会消失的。
我刚开始使用Nagios,我喜欢我的团队可以承认问题,但是我还没有find方法来logging用于纠正问题的解决scheme。 是否有一个loggingNagios警报的工具,并提供了一种方法来完成事后和日志解决scheme,以便当有人遇到类似的问题,他们可以引用logging的数据?
如何检查一个端口是否一直活着? 例如,我可以使用 ping 192.168.1.1 -t > results.txt 这将连续ping 192.168.1.1,以便我可以监控它。 有一个等同的工具或命令,我可以用这个? 目前我使用telnet,但有时主机断开连接。 我需要一个Windows解决scheme。
从上次脚本运行以来,如果主机已经重新启动,从shell脚本告诉的最好方法是什么? 我可以考虑在每次运行时将运行时间存储在一个文件中,并检查它是否已经减less,但看起来并不完全稳定(服务器可能会重启,启动速度很慢,运行时间很短,然后重新启动缓慢,更高的运行时间)。 有没有像“开始”价值,这将保证只有在重新启动才能改变? 或者其他一些检测重启的好方法?
任何关于软件的提示,如果一个Web服务器启动并运行在Linux上? 它应该能够在不知道任何东西超过URL的情况下运行。 而且它必须具有在网站停机时发送电子邮件警报的function。 对于这个我自己写一个剧本应该不难,但是如果已经有好东西的话,这似乎毫无意义。 请注意,我要监视内部服务器,因此这需要是在我的计算机上运行在同一networking上的工具,而不是基于Web的外部服务。 并注意,小而简单的解决scheme是首选。 更新 :我最终创build了一个我正在使用的小python脚本,可以在这里find。
有没有一种方法可以确定Windows中的“正常运行时间”。 失望地发现,它不是使用任务pipe理器时可用的属性之一。
我想知道是否有检查服务器是否每秒通过执行“HTTP GET请求”的优势? 任何服务器可以处理它吗?
当我们使用正常运行时 ,它只显示了我们的机器从上次打开/closures/重新启动开始的正常运行时间 。 但是,如果我想从我们的机器第一次安装的时候开始,那么该怎么办? Linux拥有这个工具吗? 或者我可以find答案的任何线索?