【问题标题】:How can I track Google Container Engine services from Stackdriver?如何从 Stackdriver 跟踪 Google Container Engine 服务?
【发布时间】:2018-09-06 10:11:03
【问题描述】:

我目前正在尝试设置 Stackdriver,以便跟踪集群中运行的各种 pod/服务的可用性,但我找不到比实例更精细的资源组跟踪方法。可以通过“标签”过滤资源,但没有关于标签是什么的文档,或者“名称”标签是否对应于 pod 名称/服务名称/容器图像名称/等。

我只想要一个资源组来跟踪我的服务容器;我该怎么做?

【问题讨论】:

    标签: kubernetes stackdriver google-kubernetes-engine google-cloud-stackdriver


    【解决方案1】:

    可以在创建service、pod等过程中分配标签或标签,见here

    之后,您将能够使用您分配的标签从 Stackdriver 信息中心“按标签分组”。

    另外,是的,有可能比实例或节点进行更精细的监控。转到 Stackdriver“Metrics explorer”并选择“GKE Con​​tainer”作为“资源类型”。这使您可以在 pod 级别监控各种指标。此外,如果您为 pod 分配了标签,您可以使用这些标签以对您有意义的方式进行过滤和分组。

    我试图避免在 pod 级别进行监控;我正在尝试在集群级别进行监控

    设置会有所不同,具体取决于您要提醒的指标缺失,但可能如下所示:

    • 登录 Stackdriver 信息中心
    • 进入群组 -> 创建群组
    • 您应该会看到创建由所有 GKE 节点组成的组的建议。如果您不使用节点的公共部分创建一个 名称作为标准
    • 选择“这是一个集群。我希望突出显示任何节点的性能或配置与其他节点不同的情况。 集群。”
    • 现在您有一个代表您的集群的组。点击“创建提醒政策”
    • 创建您需要的策略。它将适用于 组。

      如果我理解正确的话,这应该是你所需要的。

    【讨论】:

    • 是的,把它放在一起;不过,我发现的新挑战是,每当特定 pod 出现故障时,分配“指标缺失”的警报条件会提醒我,这不是我在集群中想要的 - 这意味着每当有人推出时我都会收到通知部署,这并不理想。
    • 嗯,这意味着如果某个 pod 被杀死并重新安排时间听起来不太理想,您可能会收到警报。您想在 pod 级别监控什么? Pod 可能会因多种原因被重新安排而被杀死,因此您不想在此时间引发警报。
    • 就是这样,我试图避免在 pod 级别进行监控;我正在尝试在集群级别进行监控。不过,我还没有找到一种方法来定义在集群级别工作的策略。基本上,我试图在整个 pod 集合中作为一个集群来查找指标缺失,目前它正在跟踪每个单独的 pod。
    • 感谢您的更新!老实说,这并不能真正解决我的答案——这给了我一组实例,而我真正需要的是一组活动容器。仍在努力解决这个问题。
    • 您尝试过新的 Stackdrive Kubernetes 监控吗?这可能是你需要的cloud.google.com/kubernetes-monitoring
    【解决方案2】:

    两天前,在 #KubeCon 2018 活动中,Stackdriver 的产品经理 (JD Velasquez) 宣布推出 Kubernetes 监控测试版。

    https://youtu.be/aa8cgmfHTAs(公告+演示)

    它现在是开箱即用的。

    【讨论】:

      猜你喜欢
      • 2011-06-16
      • 2017-09-13
      • 1970-01-01
      • 1970-01-01
      • 2015-10-19
      • 2017-11-15
      • 1970-01-01
      • 2016-01-18
      • 1970-01-01
      相关资源
      最近更新 更多