【问题标题】:Hortonworks Data Platform: High load causes node restartHortonworks Data Platform:高负载导致节点重启
【发布时间】:2017-11-29 11:03:58
【问题描述】:

我已经使用 Hortonworks Data Platform 2.5 设置了一个 Hadoop 集群。我正在使用 1 个主节点和 5 个从属(工作)节点。

每隔几天,我的一个(或多个)工作节点就会出现高负载,并且似乎会自动重新启动整个 CentOS 操作系统。重启后,Hadoop 组件不再运行,必须通过 Amabri 管理 UI 手动重启。

这里是“崩溃”节点的屏幕截图(大约 4 小时前的高负载值后重新启动):

这里是其他“健康”工作节点之一的屏幕截图(所有其他工作节点具有相似的值):

节点在 5 个工作节点之间交替崩溃,主节点似乎运行没有问题。

什么可能导致这个问题?这些高负载值从何而来?

【问题讨论】:

    标签: hadoop crash load hortonworks-data-platform


    【解决方案1】:

    这似乎是一个内核问题,因为日志文件(例如/var/spool/abrt/vmcore-127.0.0.1-2017-06-26-12:27:34/backtrace)说类似

    Version: 3.10.0-327.el7.x86_64
    BUG: unable to handle kernel NULL pointer dereference at 00000000000001a0
    

    运行sudo yum update 后,我得到了内核版本

    [root@myhost ~]# uname -r
    3.10.0-514.26.2.el7.x86_64
    

    自从操作系统更新后,问题不再发生。我会观察问题并在必要时提供反馈。

    【讨论】:

      猜你喜欢
      • 2014-11-24
      • 1970-01-01
      • 2012-07-24
      • 2016-09-08
      • 2018-07-12
      • 2015-03-17
      • 2020-11-17
      • 1970-01-01
      • 2019-04-04
      相关资源
      最近更新 更多