【问题标题】:How to determine the reason why kubernetes node terminated automatically?如何判断kubernetes节点自动终止的原因?
【发布时间】:2018-07-02 18:46:44
【问题描述】:

我们在 aws 中运行 kubernetes,我们在其中一个 kubernetes 节点中保存了一些文件(我知道将数据保存在主机中而不是单独的卷中是个坏主意)。由于某些未知原因,kubernetes 节点状态变为 NotReady。当我使用 describe node 命令时,我得到内存压力和磁盘压力的状态为“NodeStatusUnknown”。一段时间后,该节点被终止并自动创建新节点。由于旧节点被终止,我无法在终止节点的根卷中取回数据。现在,我怎样才能找到它被终止的原因?

【问题讨论】:

    标签: amazon-web-services kubernetes autoscaling


    【解决方案1】:

    节点状态 NotReady 导致主节点健康检查在近 3 分钟内失败。如果您已经从节点主机收集日志日志,则可以调查节点服务没有响应的原因。我遇到了一些 NotReady 问题,它们有多种原因,例如网络问题、资源不足、kubelet 服务挂起等。首先,您应该将日志收集到远程中心存储以进行检查。

    【讨论】:

    • 是的。但是,我试图从节点主机收集日志日志。但是,我什至无法对那个节点进行 SSH。
    • 所以我们应该提前配置syslog等方式,以便跟踪问题。
    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2019-10-07
    • 2016-09-04
    • 1970-01-01
    • 2018-04-28
    • 1970-01-01
    • 2013-03-27
    相关资源
    最近更新 更多