【发布时间】:2017-10-04 18:10:49
【问题描述】:
我在 AWS 实例上运行 Kubernetes 集群,并在 kubernetes 内运行 prometheus 以进行监控。 Kubernetes 外部运行了三个 etcd 服务器,我正在尝试使用 prometheus 来监控 etcd 的运行状况。
Prometheus 部署为 statefulset,并具有 kubelet、node-exporters 及其自身的指标。但是,我无法从 etcd 获得任何指标。
这是prometheus config的相关部分:
apiVersion: v1
kind: ConfigMap
metadata:
name: prometheus
namespace: monitoring
data:
prometheus.yml: |-
global:
scrape_interval: 30s
evaluation_interval: 30s
rule_files:
- /etc/alertmanager/*.rules
scrape_configs:
- job_name: etcd
scheme: https
static_configs:
- targets: ['x.x.x.x:2379']
tls_config:
ca_file: /etc/etcd/ssl/ca.pem
cert_file: /etc/etcd/ssl/client.pem
key_file: /etc/etcd/ssl/client-key.pem
insecure_skip_verify: true
- job_name: kubelets
scheme: https
tls_config:
ca_file: /var/run/secrets/kubernetes.io/serviceaccount/ca.crt
insecure_skip_verify: true
bearer_token_file: /var/run/secrets/kubernetes.io/serviceaccount/token
这是我在 Prometheus 的仪表板中遇到的错误:
Get https://x.x.x.x.:2379/metrics: x509: cannot validate certificate for x.x.x.x because it doesn't contain any IP SANs
证书是自签名的,但“insecure_skip_verify”不应该处理吗?
【问题讨论】:
标签: amazon-web-services kubernetes monitoring prometheus etcd