【问题标题】:Can't find gke metrics workload找不到 gke 指标工作负载
【发布时间】:2022-01-18 16:55:14
【问题描述】:

我发现新的 gke 指标工作负载是一个非常有趣的选项,用于测试来自自定义端点的 prometheus 输出。

我在 1.21.5-gke.1302 中配置了我的 gke 集群以在 monitoring_configuration 中使用 WORKLOADS,它在集群 kube-admin 命名空间上创建了所有必要的 pod。我还有 kubernetes 中可用的 podmonitor 资源,似乎已经准备就绪。

但是当我进入 stackdriver 指标资源管理器时,我似乎无法在其中看到我的指标。我尝试进入资源类型“Kubernetes Container”,但找不到任何“workload.googleapis.com/”。它已经运行了一个小时,我找不到指标。

有人设法从服务中获取指标吗?

【问题讨论】:

  • 你能发布你的 PodMonitor YAML 吗?我已经多次成功使用该功能。您可以检查cloud.google.com/kubernetes-engine/docs/tutorials/… 的前几个步骤,看看您所做的是否匹配。最后几个步骤配置自动缩放(我认为您不会尝试这样做)。

标签: google-cloud-platform google-kubernetes-engine gke-monitoring


【解决方案1】:

是的,我今天刚玩过这个。

首先检查gcloud beta container clustersdescribe,看看您的集群是否认为它也应该收集工作负载指标。您应该在启用的指标组件部分找到“WORKLOADS”。

gcloud beta container clusters describe example-cluster --zone chosen-zone

如果启用此功能,请通过docs 查看您在启用它时错过了什么。

【讨论】:

  • 您好,正如我在帖子中所说,我似乎没有遗漏任何内容,服务已启用,我已经通过文档...和调试部分无济于事。
  • 我明白了。不幸的是,工作负载指标还不是生产就绪的功能。如果您有支持包,请尝试开票,看看支持是否愿意为此提供帮助。我不确定你还能尝试什么。 cloud.google.com/support-hub
【解决方案2】:

好的,所以我们终于找到了问题所在。这是 pod 端口名称中的拼写错误,但在我们添加 podmonitor 时,其他一切都正常工作之前,我们没有想到要查看那里。

通过对端口名称的修复,它似乎可以工作,即使它有时会出现故障,现在它可以工作了。

【讨论】:

    猜你喜欢
    • 2021-09-01
    • 2022-09-30
    • 1970-01-01
    • 1970-01-01
    • 2022-12-07
    • 2022-10-06
    • 2021-01-27
    • 1970-01-01
    • 2020-05-08
    相关资源
    最近更新 更多