【发布时间】:2016-03-12 10:37:00
【问题描述】:
我们有一个大约有 20 个节点的集群。该集群在许多用户和作业之间共享。因此,我很难观察自己的工作,以便获得一些指标,例如 CPU 使用率、I/O、网络、内存等......
如何获得工作级别的指标。
PS:集群已经安装了 Ganglia,但不知道如何让它在工作级别上工作。我想做的是监控集群使用的资源来执行我的工作。
【问题讨论】:
-
不确定是否理解正确。您想直接从您的工作中获得不同的集群指标吗?或者您想知道您的工作使用了多少资源?
-
@maxteneff,对不起,如果我的帖子不清楚。我想知道我的工作使用了多少资源。
-
我很好奇你最终做了什么来检索你的指标?
-
你也可以在这里回答问题吗:stackoverflow.com/questions/49327187/…
标签: performance hadoop apache-spark ganglia