【发布时间】:2013-04-29 14:48:20
【问题描述】:
我听说过“Hadoop 集群”这个词,但这似乎与我对“网格”和“集群”的理解相反。
我的理解是,网格是一个分布式系统,由 2 台以上的计算机(节点)组成,这些计算机(节点)彼此共享计算资源以解决同样的问题。因此,如果您尝试进行某种繁重的科学计算、数字运算,您将创建一个机器网格来协作解决同一个问题。
我对集群的理解是它是一个分布式系统,由 2 台以上的计算机组成,这些计算机都独立工作以解决不同的、较小的问题时间>。因此,您通常会在负载均衡器后面放置一个集群,并在负载均衡器分配给每个节点时让每个节点解决一个小问题。
所以,如果我的理解是正确的,那么您可以使用网格来解决少量庞大(计算量大)的作业,并使用集群来解决大量小型(计算量少)作业。
所以首先,如果我对网格和集群的理解不正确,请先纠正我!
假设我或多或少是正确的,那么为什么我们有 Hadoop集群?如果 Hadoop 的目的是解决大数据问题(一些计算量很大的问题)并使用大量商用硬件来创建大量能够与其他节点协作来解决相同问题的节点,那不就是 网格吗? ?
说我们有 Hadoopgrids 是否更正确?为什么或者为什么不?提前致谢!
【问题讨论】:
-
维基百科有一些 examples of grid computing 可能会清除区别。
标签: hadoop grid cluster-computing distributed-computing bigdata