【发布时间】:2014-11-14 10:27:03
【问题描述】:
我想要一个应用程序 -
- 从 MSSQL Server 读取数据
- 将此数据放入 spark 中
- 使用 RDD 执行计算
- 使用 JDBCRDD 将数据写入另一个数据库
我的问题是没有。 4关于使用JDBCRDD将数据写入另一个数据库,在创建JDBCRDD时我们指定连接参数。
当我们创建 JDBCRDD 并且它分布在集群节点上时,连接对象是如何分布的? spark setup中是为每个partition/node创建分布式还是多个连接对象?
【问题讨论】:
-
所以你问题的第一段与我们完全无关?