【问题标题】:Large-scale service monitoring at regular intervals [closed]定期进行大规模服务监控[关闭]
【发布时间】:2013-12-08 02:39:38
【问题描述】:

我需要跨大量服务器获取服务状态,以便计算正常运行时间百分比。我可能需要使用多台服务器进行检查。有谁知道在特定时间/间隔将它们排队以进行检查的可靠方法?

我正在用 PHP 编写应用程序,但我愿意为此使用其他语言和工具。我唯一的要求是它必须在 Linux 上运行。

我已经研究过 Gearman 之类的工作队列,但我没有找到任何可以很好地工作的东西。

【问题讨论】:

  • 建议您扩展您的问题以描述您正在使用的特定技术、您尝试过的选项以及您所面临的限制 - 就目前而言,这个问题非常广泛并且可能会被标记.
  • 最好在问题中添加这种东西(并尽可能扩展它),这样你就不会得到大量的反对意见;)

标签: php curl


【解决方案1】:

为了获得服务的正常运行时间百分比,您可以执行命令来检查服务状态并记录它们以供进一步分析/计算。以下是一些相同的方法:

  1. 诸如topfree -mvmstatiostatiotopsarnetstat 等系统命令。当您分析/调试问题时,这些 linux 实用程序附近没有任何东西。这些命令让您清楚地了解服务器内部的情况
  2. SeaLion:代理执行#1 中提到的所有命令以及自定义命令。可以在漂亮的 Web 界面中访问这些命令的输出。当您在数百台服务器上工作时,此工具会派上用场,因为安装非常简单。而且它是免费的
  3. Nagios:它是所有监控/警报工具之母。它非常可定制,但对于初学者来说很难设置。虽然有一些 nagios 插件。
  4. 穆宁
  5. 服务器密度:一种基于云的付费服务,可收集重要的 Linux 指标并让用户能够编写自己的插件。
  6. New Relic:另一个著名的托管监控服务。
  7. 扎比克斯

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 2012-09-17
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多