【发布时间】:2016-01-27 17:08:23
【问题描述】:
仅将 spark 用于分布式任务执行是否有益。我有处理大型数据集的要求(从数据库读取、处理、写入数据库),但是完成的处理是行级的。这意味着我不需要 reduce 或机器学习。
使用 spark 来满足这种要求会不会有点过头了。什么最适合这种要求。我不想编写将优化分布、处理故障、重试等的软件基础架构
【问题讨论】:
标签: apache-spark distributed distributed-computing
仅将 spark 用于分布式任务执行是否有益。我有处理大型数据集的要求(从数据库读取、处理、写入数据库),但是完成的处理是行级的。这意味着我不需要 reduce 或机器学习。
使用 spark 来满足这种要求会不会有点过头了。什么最适合这种要求。我不想编写将优化分布、处理故障、重试等的软件基础架构
【问题讨论】:
标签: apache-spark distributed distributed-computing
【讨论】: