【问题标题】:Prometheus HA in Kubernetes (AKS)Kubernetes 中的 Prometheus HA (AKS)
【发布时间】:2020-06-17 19:03:01
【问题描述】:

我正在运行以下掌舵图 (https://github.com/helm/charts/tree/master/stable/prometheus),其中 server.replicaCount =2 和 server.statefulSet.enabled = true。

对于存储,我使用两个管理磁盘(不是不是 POSIX 的 Azure 文件)(2 个 PV 和 2 个 PVC)是在图表部署期间创建的。

我的问题是: 这是 HA 解决方案吗?指标是否写入两个 prometheus 实例(一个具有公共 ip 和无头“服务”的服务被创建)并复制到两个磁盘?

这个复制品是如何工作的?

谢谢,

【问题讨论】:

    标签: kubernetes monitoring prometheus high-availability


    【解决方案1】:

    遗憾的是,正如 Piotr 所指出的,这不是真正的 HA 产品,Thanos 通常是这种设置的首选方式,但并非没有它自己的陷阱。您拥有的集群数量是一个因素,您可能需要某种工具帐户才能始终跟踪更改。

    我可以为您提供this excellent talk,其中包括一个现场演示,并展示了它在实践中的工作原理。

    【讨论】:

      【解决方案2】:

      不,这不是 HA 解决方案。这只会将部署扩展为始终拥有 2 个副本,它们都在有状态集上。

      为了在 Kuberetes 上实现 HA 监控,需要用到动态故障检测和路由工具。

      有几篇关于让 prometheus 与 HA 一起工作的文章:

      Deploying an HA Prometheus in Kubernetes on AWS — Multiple Availability Zone Gotchas

      HA Kubernetes Monitoring using Prometheus and Thanos

      副本数仅指示部署始终具有至少 2 个正在运行的部署 pod 实例。您可以在 Kubernetes documentation 中找到有关副本的更多信息。

      在 helm chart documentation 中,似乎还有其他选项,例如 server.service.statefulsetReplica.enabledserver.service.statefulsetReplica.replica,但我认为这些只是可以帮助创建 HA prometheus 的工具。不是从一开始就准备好的解决方案。

      希望对你有帮助。

      【讨论】:

      • 你好。感谢您的澄清回答。即使我需要一些动态故障检测机制(带侧车的Thanos),相同的数据(指标)是否会出现在两个实例/磁盘上?例如,推送网关的指标只针对一个副本?还是两者兼而有之?
      猜你喜欢
      • 1970-01-01
      • 2019-12-31
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2020-08-03
      • 1970-01-01
      • 2018-02-14
      • 1970-01-01
      相关资源
      最近更新 更多