【发布时间】:2017-04-17 20:06:57
【问题描述】:
如果我必须处理 1000 万条记录并在其中一列中搜索字符串匹配,我可以使用 java.util.
在 spark 中我比 java 有什么优势?
【问题讨论】:
-
对于初学者来说,Spark 是分布式的。如果您只有一个单线程 Java 或 Spark 节点,那么几乎没有区别。
-
谢谢。为什么投反对票?
-
没有投反对票,但问题可能缺少研究工作。
-
不要假设懒惰,这可能是缺乏理解力。我确实试图找出答案,浏览了很多文档,详细说明了如何做某事,但找不到原因。如果您有链接分享将不胜感激。
-
假设留给读者。随意edit您的问题与您参考/尝试过的事情
标签: java apache-spark cassandra