【发布时间】:2017-05-03 22:10:15
【问题描述】:
我对 Hadoop namenode 内存计算有一个愚蠢的怀疑。它在 Hadoop book (Definite guide) 中被提及为
“由于namenode将文件系统元数据保存在内存中,文件系统中文件数量的限制取决于namenode上的内存量。根据经验,每个文件、目录和块大约需要150字节。因此,例如,如果您有 100 万个文件,每个文件占用一个块,则您将需要至少 300 MB 的内存。虽然存储数百万个文件是可行的,但数十亿个文件超出了当前硬件的能力。"
由于每个占用一个块,namenode最小内存应该是150MB而不是300MB。请帮助我理解为什么是300MB
【问题讨论】: