【问题标题】:Nodetool describecluster list all nodes unreachableNodetool describecluster 列出所有无法访问的节点
【发布时间】:2021-01-23 12:58:38
【问题描述】:

我在两个公共网络上部署 cassandra,当节点启动时,我可以看到所有节点都已加入环。 nodetool describecluster 还显示所有节点都可以访问。

一段时间后,我看到节点无法相互连接,nodetool describecluster 显示了无法访问列表中的所有节点。

仅供参考,我使用 public_ip 作为 BROADCAST_ADDRESS 和 RPC_ADDRESS。监听地址为private_ip。

【问题讨论】:

  • 嗯,可能想tail system.log 每个文件,看看它们为什么没有响应。

标签: cassandra cassandra-3.0 nodetool


【解决方案1】:

发生这种情况的一个原因是防火墙有时被配置为查找并终止空闲连接。 Linux 内核具有默认的 TCP “keepalive”设置,可用于刷新长时间运行的连接。可以使用sysctl查看这些设置的默认值:

$ sudo sysctl -a | grep keepalive
net.ipv4.tcp_keepalive_intvl = 75
net.ipv4.tcp_keepalive_probes = 9
net.ipv4.tcp_keepalive_time = 7200

为了解决这个问题,DataStax recommends adjusting these values in production 部署:

$ sudo sysctl -w \
net.ipv4.tcp_keepalive_time=60 \
net.ipv4.tcp_keepalive_probes=3 \
net.ipv4.tcp_keepalive_intvl=10

您还可以将这些值中的每一个添加到系统的/etc/sysctl.conf 文件中(减去反斜杠)并通过sysctl 实现它:

sudo sysctl -p /etc/sysctl.conf

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 2019-02-02
    • 1970-01-01
    • 1970-01-01
    • 2019-08-14
    • 2018-07-22
    • 1970-01-01
    • 1970-01-01
    • 2021-09-05
    相关资源
    最近更新 更多