【问题标题】:HPA auto-scaling at deployment based on HTTP requests count基于 HTTP 请求计数的部署时 HPA 自动扩展
【发布时间】:2020-03-03 05:22:49
【问题描述】:

根据 HTTP 请求率,我遇到了 HPA 配置问题。我正在使用基于 Prometheus 指标的速率 - sum(rate(http_server_requests_seconds_count[5m])) - 但在启动时 HPA 会自动缩放到最大数量的 pod,尽管没有收到 HTTP 请求。请参阅下面 kubectl describe hpa 的摘录,显示它正在根据指标进行扩展,并且这发生在部署后的几秒钟内。

Normal  SuccessfulRescale  23m (x4 over 128m)   horizontal-pod-autoscaler  New size: 2; reason: pods metric rate_5m_http_server_requests_seconds_count above target
Normal  SuccessfulRescale  23m (x4 over 128m)   horizontal-pod-autoscaler  New size: 3; reason: pods metric rate_5m_http_server_requests_seconds_count above target

是否可以告诉 Kubernetes 在前 N 秒/分钟内不要进行扩展,或者是否有其他方法可以解决这个问题?

【问题讨论】:

  • 也许,调整 kube-controller-manager --horizontal-pod-autoscaler-tolerance 标志的值可以帮助你。
  • 感谢@EduardoBaitello,但我认为这不会有帮助。最初,我不小心将预期值设置为 5000,认为这是 5 分钟内的总请求数,而不是过去 5 分钟内的速率。它甚至使用这个值自动缩放,所以我不确定它是否在进行自动缩放时检查该值。
  • 你能确认它实际上是一个错误吗?
  • 在我看来这确实是一个错误。尽管基于不同的指标,但它看起来与上面报告的错误相同。

标签: kubernetes autoscaling kubernetes-hpa


【解决方案1】:

正如@James 在 cmets 中提到的,这是一个正在跟踪 herehere 的错误。

我将此作为社区 wiki 发布,以提高知名度。

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 2020-04-10
    • 2020-10-06
    • 2020-02-20
    • 1970-01-01
    • 2012-04-21
    • 2012-03-14
    • 1970-01-01
    相关资源
    最近更新 更多