【问题标题】:Kube-up.sh loops forever in specific AWS regionKube-up.sh 在特定 AWS 区域中永远循环
【发布时间】:2015-12-29 18:00:47
【问题描述】:

当我尝试在 AWS 中设置新的 Kubernetes 集群时,我遇到了非常奇怪的行为。

每当我尝试使用默认配置运行 kube-up.sh 时,它都能完美运行, 集群及其所有相关组件将在 10 分钟内完成设置。

当我将“kube-aws-zone”设置为 us-east-1e(与我当前的 VPC 相同)而不是 us-west-2a(默认)时,会出现问题。 安装过程陷入循环并显示以下消息 -

等待 3 分钟让集群稳定下来............重新运行 salt highstate sudo:无法解析主机 ip-172-20-0-9 等待 集群初始化。

这将不断检查 kubernetes 的 API 是否 可达。如果有一些未捕获的错误,这可能会永远循环 在启动期间。

我尝试在 minions 中挖掘一下,并在 /var/log/salt/minion 中找到了这个错误

2015-10-01 14:52:54,912 [salt.loaded.int.module.cmdmod][错误] 命令 'runlevel /run/utmp' 失败,返回码:1 2015-10-01 14:52:54,913 [salt.loaded.int.module.cmdmod][ERROR] 输出:太 许多论点。 2015-10-01 14:53:00,902 [salt.state][错误] 命名服务 kubelet 不可用 2015-10-01 14:53:03,078 [salt.state ][ERROR ] 命名服务 kube-proxy 不是 可用 2015-10-01 14:53:16,677 [salt.state][ERROR] An 在这种状态下发生异常:Traceback(最近一次调用最后一次):
文件“/usr/lib/python2.7/dist-packages/salt/state.py”,第 1533 行,在 称呼 **cdata['kwargs']) 文件“/usr/lib/python2.7/dist-packages/salt/states/sysctl.py”,第 56 行,在 展示 已配置 = salt'sysctl.show' 文件“/usr/lib/python2.7/dist-packages/salt/modules/linux_sysctl.py”,行 86,在节目中 对于 salt.utils.fopen(config_file_path) 中的行:文件“/usr/lib/python2.7/dist-packages/salt/utils/init.py”,第 1065 行, 在 fopen fhandle = open(*args, **kwargs) IOError: [Errno 2] No such file or directory: '/etc/sysctl.d/99-salt.conf'

2015-10-01 14:53:16,707 [salt.loaded.int.module.cmdmod][错误] 命令 'runlevel /run/utmp' 失败,返回码:1 2015-10-01 14:53:16,708 [salt.loaded.int.module.cmdmod][ERROR] 输出:太 许多论点。 2015-10-01 14:53:16,719 [salt.loaded.int.module.cmdmod][错误] 命令'服务泊坞窗 status' 失败并返回代码:3 2015-10-01 14:53:16,719 [salt.loaded.int.module.cmdmod][ERROR] 输出:* docker.service - Docker 应用程序容器引擎已加载:已加载 (/lib/systemd/system/docker.service;已启用;供应商预设:已启用) 活动:自周四以来激活(自动重启)(结果:退出代码) 2015-10-01 14:53:16 UTC; 262 毫秒前 文档:http://docs.docker.com 进程:15285 ExecStart=/usr/bin/docker -d -H fd:// $DOCKER_OPTS (code=exited, status=1/FAILURE) 主 PID: 15285 (code=exited, status=1/FAILURE)

10 月 1 日 14:53:16 ip-172-20-0-90 systemd[1]: docker.service: main 进程退出,code=exited,status=1/FAILURE Oct 01 14:53:16 ip-172-20-0-90 systemd[1]:单元 docker.service 进入失败状态。 10 月 1 日 14:53:16 ip-172-20-0-90 systemd[1]:docker.service 失败。 2015-10-01 14:53:20,259 [salt.state][ERROR] 命名 服务 kubelet 不可用 2015-10-01 14:53:20,687 [salt.state
][ERROR ] 命名服务 kube-proxy 不可用

我已尝试按照类似问题的建议删除并重新设置 IAM 角色,但最终没有成功。

将不胜感激任何帮助。 谢谢,

【问题讨论】:

    标签: amazon-web-services kubernetes


    【解决方案1】:

    这个问题是 us-east-1 地区特有的。 我必须编辑作为 kube-up.sh 一部分创建的 dhcp-set 并添加以下内容 -

    域名 = ec2.internal

    然后它就像魅力一样。

    更多信息 - https://github.com/kubernetes/kubernetes/issues/7962#issuecomment-145324441

    【讨论】:

      猜你喜欢
      • 2017-01-11
      • 1970-01-01
      • 1970-01-01
      • 2015-08-17
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2014-05-30
      相关资源
      最近更新 更多