【发布时间】:2019-07-17 23:10:03
【问题描述】:
我一直在尝试按照以下教程运行一个基本的 Kubernetes 集群https://kubernetes.io/docs/setup/independent/install-kubeadm/
我从最新的 ubuntu 16.04 系统开始并安装了 docker。
wget -qO- https://get.docker.com/ | sed 's/docker-ce/docker-ce=18.06.3~ce~3-0~ubuntu/' | sh
之后我安装了 kubelet / Kubeadm 和 kubectl 模块
apt-get update && apt-get install -y apt-transport-https curl
curl -s https://packages.cloud.google.com/apt/doc/apt-key.gpg | apt-key add -
cat <<EOF >/etc/apt/sources.list.d/kubernetes.list
deb https://apt.kubernetes.io/ kubernetes-xenial main
EOF
apt-get update
apt-get install -y kubelet kubeadm kubectl
apt-mark hold kubelet kubeadm kubectl
确保交换等已关闭sudo swapoff -a
使用sudo kubeadm init 执行初始化
[init] Using Kubernetes version: v1.13.3
...
To start using your cluster
...
mkdir ...
You can now join any ...
...
我制作 .kube 文件夹并进行配置
mkdir -p $HOME/.kube
sudo cp -i /etc/kubernetes/admin.conf $HOME/.kube/config
sudo chown $(id -u):$(id -g) $HOME/.kube/config
kubectl cluster-info 然后显示
To further debug and diagnose cluster problems, use 'kubectl cluster-info dump'.
The connection to the server 10.117.xxx.xxx:6443 was refused - did you specify the right host or port?
在尝试了几次之后,我收到了:
sudo kubectl cluster-info
Kubernetes master is running at https://10.117.xxx.xxx:6443
KubeDNS is running at https://10.117.xxx.xxx:6443/api/v1/namespaces/kube-system/services/kube-dns:dns/proxy
但是一秒钟后它又回到了权限被拒绝
sudo kubectl cluster-info
To further debug and diagnose cluster problems, use 'kubectl cluster-info dump'.
The connection to the server 10.117.xxx.xxx:6443 was refused - did you specify the right host or port?
我尝试使用和不使用 sudo... 并且 sudo kubectl get nodes 也拒绝工作。
The connection to the server 10.117.xxx.xxx:6443 was refused - did you specify the right host or port?
我错过了什么无法连接?
ping 10.117.xxx.xxx 可以正常工作,甚至 ssh 到此地址也可以正常工作并且是同一台服务器。
编辑
sudo systemctl restart kubelet.service 显示集群上线,但由于某种原因在几分钟内下线。
kubectl cluster-info
Kubernetes master is running at https://10.117.0.47:6443
KubeDNS is running at https://10.117.0.47:6443/api/v1/namespaces/kube-system/services/kube-dns:dns/proxy
...
kubectl cluster-info
To further debug and diagnose cluster problems, use 'kubectl cluster-info dump'.
The connection to the server 10.117.0.47:6443 was refused - did you specify the right host or port?
edit2
在进行完全重置并使用以下初始化后...
sudo kubeadm init --pod-network-cidr=10.244.0.0/16
紧随其后
kubectl apply -f https://raw.githubusercontent.com/coreos/flannel/a70459be0084506e4ec919aa1c114638878db11b/Documentation/kube-flannel.yml
允许我安装 pod 网络插件,但只是短暂的。
clusterrole.rbac.authorization.k8s.io/flannel created
clusterrolebinding.rbac.authorization.k8s.io/flannel created
serviceaccount/flannel created
configmap/kube-flannel-cfg created
daemonset.extensions/kube-flannel-ds-amd64 created
daemonset.extensions/kube-flannel-ds-arm64 created
daemonset.extensions/kube-flannel-ds-arm created
daemonset.extensions/kube-flannel-ds-ppc64le created
daemonset.extensions/kube-flannel-ds-s390x created
kubectl cluster-info
Kubernetes master is running at https://10.117.xxx.xxx:6443
KubeDNS is running at https://10.117.xxx.xxx:6443/api/v1/namespaces/kube-system/services/kube-dns:dns/proxy
To further debug and diagnose cluster problems, use 'kubectl cluster-info dump'.
➜ ~ kubectl cluster-info
To further debug and diagnose cluster problems, use 'kubectl cluster-info dump'.
The connection to the server 10.117.xxx.xxx:6443 was refused - did you specify the right host or port?
edit3
删除所有 docker 映像、容器等...然后使用 sudo systemctl restart kubelet.service 重新启动似乎可以解决几分钟的问题,但随后所有 docker 容器都被杀死并删除,没有任何信号。我如何查看这些容器的日志记录以找出它们被杀死的原因?
【问题讨论】:
-
检查这个以获得logs
标签: ubuntu kubernetes