【发布时间】:2019-06-11 01:31:57
【问题描述】:
我是 Kubernetes 领域的新手,如果我在这里遗漏了任何明显的东西,请见谅。
我在 GKE 中运行 Prometheus,它必须抓取 GCE 中安装的端点上公开的指标,GCE 中的主机位于 VPN 后面,我不确定这是否是一个问题,因为两者都在 Google 云上。我可以在这里做些什么来确保 kubernetes 中的 prometheus 可以连接到 GCE 中的主机并从它们中抓取指标。
编辑:添加配置和错误消息
普罗米修斯 scrape_config
- job_name: 'cassandra-metrics'
static_configs:
- targets:
- <ip>:<port>
尝试抓取时出错
net_conntrack_dialer_conn_failed_total{dialer_name="cassandra-metrics",reason="timeout"} 4675
【问题讨论】:
-
如何抓取指标?
-
这里是 scrape_config
- job_name: 'cassandra' static_configs: - targets: - <ip>:<port>,我在 prometheus 指标页面net_conntrack_dialer_conn_failed_total{dialer_name="cassandra-metrics",reason="timeout"} 4675中看到了超时消息 -
我没有看到任何不应该工作的东西,即使是在 VPN 之后,但防火墙规则会有点棘手
-
创建了防火墙规则以允许从所有子网进入主机的流量,但仍然无法抓取指标。 Kuberentes 集群和主机在 GCP 中位于不同的可用区,不确定这是否是一个问题。
-
不应该,防火墙规则应该在2个网络/项目中以允许入口和出口
标签: kubernetes google-cloud-platform prometheus google-kubernetes-engine