【发布时间】:2019-04-01 05:10:26
【问题描述】:
我正在尝试寻找能够实现以下功能的数据库解决方案。
- 存储由表名分隔的平面、随机 JSON 结构(例如 random_json_table_1、random_json_table_2)。
- 能够处理大量插入操作(+10000/秒)。
- 能够查询随机 json 结构(SELECT * FROM random_json_table_1 WHERE JSON_SELECT('data', '$.city.busses') NOT NULL AND JSON_SELECT('data', '$.city.busStops', 'length' ) > 5) 例如。
- SELECT 查询必须在千兆字节的数据上快速运行。
我查看了 Amazon Athena,它看起来很有希望,但我很好奇是否还有其他解决方案。
【问题讨论】:
-
您能否澄清一下进入给定表的 JSON 记录是否都具有相同的对象结构?如果是这样,那么 Google BigQuery 就是一个候选者......请参阅 cloud.google.com/bigquery/docs/loading-data-cloud-storage-json
-
表的结构是一样的,例如... id, organization_id, json_data 但是json_data的内容是随机的。
标签: json database amazon-web-services google-cloud-platform nosql