【发布时间】:2021-09-13 18:17:07
【问题描述】:
我使用 ADF/synapse 管道将我的事实数据从源提取到专用 sql 池中的暂存模式表。
我现在的任务是使用代理键丰富事实数据,该代理键是通过从 prod 模式中已经存在的小维度表中查找来实现的。
为此,我一直在使用 ADF/突触数据流,但它似乎效率低下,因为它将数据移回 ADF。我可以通过 spark notebook 做到这一点,但似乎也是不必要的数据移动。
所以我认为最好的方法是在专用的 sql 池上创建一个存储过程来执行这种扩充。我关心的是确保这个 sql proc 以高性能的方式编码(而不是逐行插入)。
有很多 proc 示例从无到有 (ctas) 创建表,但我还没有找到以可扩展方式执行丰富/追加操作的示例。对此有什么好的 sql 代码实践?
【问题讨论】:
标签: azure-synapse