【发布时间】:2020-03-03 05:22:49
【问题描述】:
根据 HTTP 请求率,我遇到了 HPA 配置问题。我正在使用基于 Prometheus 指标的速率 - sum(rate(http_server_requests_seconds_count[5m])) - 但在启动时 HPA 会自动缩放到最大数量的 pod,尽管没有收到 HTTP 请求。请参阅下面 kubectl describe hpa 的摘录,显示它正在根据指标进行扩展,并且这发生在部署后的几秒钟内。
Normal SuccessfulRescale 23m (x4 over 128m) horizontal-pod-autoscaler New size: 2; reason: pods metric rate_5m_http_server_requests_seconds_count above target
Normal SuccessfulRescale 23m (x4 over 128m) horizontal-pod-autoscaler New size: 3; reason: pods metric rate_5m_http_server_requests_seconds_count above target
是否可以告诉 Kubernetes 在前 N 秒/分钟内不要进行扩展,或者是否有其他方法可以解决这个问题?
【问题讨论】:
-
也许,调整 kube-controller-manager
--horizontal-pod-autoscaler-tolerance标志的值可以帮助你。 -
感谢@EduardoBaitello,但我认为这不会有帮助。最初,我不小心将预期值设置为
5000,认为这是 5 分钟内的总请求数,而不是过去 5 分钟内的速率。它甚至使用这个值自动缩放,所以我不确定它是否在进行自动缩放时检查该值。 -
你能确认它实际上是一个错误吗?
-
在我看来这确实是一个错误。尽管基于不同的指标,但它看起来与上面报告的错误相同。
标签: kubernetes autoscaling kubernetes-hpa