【发布时间】:2021-03-23 21:41:47
【问题描述】:
用例如下: 我们有一个表 foo,它的数据每天都会被替换。我们想开始将旧数据保存在一个名为 foo_HIST 的历史摄取时间分区表中。
我有以下 google-cloud bigquery 代码:1.6.1
bq_client = bigquery.Client(project=env_conf.gcp_project_id)
dataset = bigquery.dataset.DatasetReference(
env_conf.gcp_project_id, env_conf.bq_dataset
)
full_table_src = table_conf.table_name()
table_src = dataset.table(full_table_src)
table_dst_name = f"{full_table_src}_HIST"
table_dst = dataset.table(table_dst_name)
table_dst.time_partitioning = bigquery.TimePartitioning(
type_=bigquery.TimePartitioningType.HOUR,
)
# Truncate per partition.
job_config = bigquery.CopyJobConfig(
create_disposition="CREATE_IF_NEEDED",
write_disposition="WRITE_TRUNCATE",
)
job = bq_client.copy_table(table_src, table_dst, job_config=job_config)
确实创建了新表,但是当我使用 bq cli 检查它时,它似乎不是基于分区的表。这是输出。
bq show --format=prettyjson dataset_id.foo_HIST
{
"creationTime": "1616418131814",
"etag": "iqfdDzv2ifdsfERfwTiFjQ==",
"id": "project_id:dataset_id.foo_HIST",
"kind": "bigquery#table",
"lastModifiedTime": "1616418131814",
"location": "EU",
"numBytes": "32333",
"numLongTermBytes": "0",
"numRows": "406",
"schema": {
"fields": [
{
"mode": "NULLABLE",
"name": "MPG",
"type": "FLOAT"
},
]
},
"selfLink": "https://bigquery.googleapis.com/bigquery/v2/projects/project_id/datasets/dataset_id/tables/foo_HIST",
"tableReference": {
"datasetId": "dataset_id",
"projectId": "project_id",
"tableId": "foo_HIST"
},
"type": "TABLE"
}
【问题讨论】:
标签: python google-bigquery partitioning