【发布时间】:2017-12-08 04:46:52
【问题描述】:
通过并行数据移动将数据从 Teradata 数据库并行摄取到 Hadoop 中的最佳方法是什么?
- 如果我们创建一个简单的作业,打开一个与 Teradata 数据库的会话,加载巨大的表将花费大量时间。
- 如果我们创建一组会话来并行加载数据,并在每个会话中进行 Select,那么它将进行一组全表扫描 Teradata 以生成数据
在并行流中加载数据并对 Teradata 产生不必要的工作负载时,推荐的最佳做法是什么?
【问题讨论】:
标签: hadoop teradata informatica informatica-powercenter bigdata