【发布时间】:2016-02-21 08:31:20
【问题描述】:
我打算使用现有数据开发一个报告平台。我有一个现有的 RDBMS,它有大量的记录。所以我正在使用。 (Hadoop 2.7, Spark, Hive, JasperReports, Scoop - Architecuture)
- Scoop - 将数据从 RDBMS 提取到 Hadoop
- Hadoop - 存储平台
- Hive - 数据仓库
- Spark - 由于 Hive 更像是批处理,Hive 上的 Spark 将加快处理速度
- JasperReports - 生成报告。
鉴于我已经阅读了以下内容
我应该使用哪种模式?为什么?决定基于什么?
【问题讨论】:
标签: hadoop apache-spark hadoop-yarn