【发布时间】:2018-12-31 13:02:48
【问题描述】:
对于流式插入,我想使用一个模板表(带有用户 ID 后缀),它本身就是一个分区表。通过这种方式,我可以使我的表比仅使用分区表更小,从而使我的查询更具成本效益。此外,无论我的系统中有多少用户,我的每个用户的查询成本都保持不变。根据https://cloud.google.com/bigquery/streaming-data-into-bigquery:-的文档@
要按日期创建较小的数据集,请使用时间分区表。要创建不基于日期的较小表,请使用模板表,BigQuery 会为您创建表。
听起来好像可以是时间分区表或模板表。不能两者兼而有之吗?如果没有,我应该研究另一种架构吗?
关于我上面提出的架构的另一个问题是我在 https://cloud.google.com/bigquery/docs/partitioned-tables 上看到的 4000 限制。 是否意味着我的分区表不能覆盖超过 4000 天?在这种情况下我是否必须删除旧分区,或者最后一个分区是否会继续存储任何后续流数据?
【问题讨论】:
-
查看以下问题,了解如何通过按周/月/年进行分区来绕过此限制:stackoverflow.com/a/56125049/132438
标签: google-bigquery