【发布时间】:2015-07-05 21:00:30
【问题描述】:
我刚刚读到https://stackoverflow.com/a/19974621/260805。从 Cassandra 集群读取数据时,Spark(特别是 Datastax 的 Cassandra Spark 连接器)是否会产生与 Hadoop 相同的开销?我知道 Spark 比 Hadoop 更多地使用线程。
【问题讨论】:
-
运行一个较小的非科学基准来测试这一点。如果没有其他人回应,我至少会分享我的发现。
标签: apache-spark cassandra-2.0 datastax-enterprise