【发布时间】:2017-03-07 21:30:09
【问题描述】:
我想为提取作业分配更多的顶点,尝试使用 ROWCOUNT 提示,它似乎不起作用,无论我为 ROWCOUNT 使用什么值,U-SQL 总是分配相同数量的顶点。
提取 xxxx 来自@“路径” 使用新的 RndsInDataLakeCode.PyramidExtractorMerged() 选项(行数=50000000); 有没有其他方法可以影响顶点分配
谢谢。
【问题讨论】:
-
你的路径匹配了多少个文件?我的印象(到目前为止只尝试过 AvroExtractor)每个文件一个顶点,没有像 Hadoop 那样的文件拆分。
-
此作业从 800 个文件中提取。
标签: azure-data-lake u-sql data-lake