【发布时间】:2014-05-30 05:11:56
【问题描述】:
我有 1 台主服务器和 5 台区域服务器,每台服务器都有 200 GB 磁盘空间和 16 GB RAM。我在 HBase 中创建了一个包含 1000 万条记录的表。我在 hadoop 2 上使用 hbase-0.96 版本。
表名 - sh_self_profiles
列族 - 简介
在此表中,每行有 30 列。 当我从 HBase 获得单列值时,大约需要 10 毫秒。我的问题是当我达到 100 个或更多并发请求时,时间会慢慢累积并增加到 400 多毫秒,而不是仅在 10 毫秒内完成。线性命中 100 个请求时,每个请求只需要 10 毫秒。
【问题讨论】:
-
添加更多关于您的密钥设计、hbase 内存设置等的信息。
-
记录有多大?它们是 1 亿条 1MB 记录还是 10 字节记录?这有很大的不同。
-
读取是如何分布的?统一?您是否一遍又一遍地访问同一行?