【发布时间】:2021-05-15 04:43:49
【问题描述】:
我们正在将实时数据流式传输到 Redshift。瓶颈是没有可以同时运行的表加载。我们目前每 15 分钟运行超过 1000 次以上的负载。
但我们希望根据用户使用这些表的频率来减少这个数字。请建议我们如何在 Redshift 中获取此信息。
【问题讨论】:
-
如果我可以问,你对
VACUUM做了什么? -
还没有觉得有必要对此进行优化。正如我在其他问题中所说的那样。谢谢。
-
VACCUM 不是优化。它是红移。如果不使用 VACUUM,则使用 Redshift 完全没有意义 - Redshift 允许通过排序表对大数据进行及时的 SQL,而 VACUUM 是排序的核心。如果 VACUUM 没有被使用,表没有排序,Redshift 无法在大数据上提供及时的 SQL - 并且没有其他理由使用它,因为它是在大量使用时 效率低下,成本高昂,并且伴随着大量繁重的约束和要求。
-
为什么您认为 aws auto vaccum 不起作用?
-
今天让我测试一下我自己做vaccum是否增加了性能。谢谢。
标签: amazon-web-services amazon-redshift