【发布时间】:2018-05-15 06:11:39
【问题描述】:
我已经看到 articles recommending 应该实施资源请求/限制。但是,我发现没有一个讨论关于要填写的什么数字。
例如,假设一个容器在空闲时使用零 CPU,在正常用户请求下使用 80%,在遇到一些罕见请求时使用 200% CPU:
- 如果我将最大值 2000m 作为 CPU 请求,那么内核大部分时间都会处于空闲状态
- 另一方面,如果我请求 800m 并且多个 pod 同时达到其 CPU 限制,则上下文切换开销将开始
也有这样的情况
- 内部工具大部分时间处于闲置状态,然后在活跃使用时跃升至 200%
- 具有不同高峰时间的应用程序。例如,人们在工作时间使用的 SaaS 和人们下班后开始加载的聊天机器人。如果他们可以共享未使用的容量,那就太好了。
理想情况下vertical pod autoscaler 可能会自动解决这些问题,但它今天仍处于 alpha 阶段。
【问题讨论】:
-
VPA 已作为 K8s 1.12 的 CRD 发布测试版:stackoverflow.com/a/52565871/6309
标签: kubernetes