【发布时间】:2015-12-02 09:57:43
【问题描述】:
我们正在探索用于 cassandra 的 SPARK,以克服 CQL 的限制。
我们最初仅限于 CQL,但在 RDBMS 上遇到了一些障碍/障碍。仅举几例如下
- 为了比较列上的 >(大于) 和 ,我们被限制为具有聚类键中的列。即使我在集群中有一个列,我仍然应该提供分区键以在集群键上执行 。
- 无法检查任何列值是否为 NULL
- 为了查询其他分区键的任何列,我们必须在该列上创建索引
- ORDER BY 不是 CLUSTERING KEY 的列
- 按限制分组
- 加入表
我是 cassandra 的新手,由于限制,我经常重新访问我的架构。
因此类似于 HDFS 的 HIVE/PIG,Spark 与 CQL 相比有哪些额外的好处?
【问题讨论】:
标签: apache-spark cassandra cql3 spark-cassandra-connector