【发布时间】:2014-05-20 05:31:21
【问题描述】:
分布式缓存实际上是什么意思?在分布式缓存中拥有一个文件意味着它在每个数据节点中都可用,因此该数据不会有节点间通信,还是意味着文件在每个节点的内存中? 如果没有,我可以通过什么方式在整个作业的内存中保存一个文件?是否可以为 map-reduce 以及 UDF 完成此操作..
(特别是有一些配置数据,相对较小,我想将它们保存在内存中,因为 UDF 适用于 hive 查询...?)
感谢和问候, 德鲁夫·卡普尔。
【问题讨论】:
标签: caching hadoop hive distributed-cache