【发布时间】:2018-01-08 20:30:17
【问题描述】:
我正在比较具有某些“属性”要查询的大量文件的云存储。现在它大约有 2.5TB 的文件并且增长很快。我需要高吞吐量的写入和查询。我将首先编写要存储的文件和属性,然后查询汇总属性(计数等),另外查询属性以提取一小组文件(按日期、名称等)。
我已将 Google Cloud Datastore 作为 noSQL 选项进行了探索,但试图将其与 AWS 服务进行比较。
一种选择是使用“标签”将文件存储在 S3 中。我相信您可以使用 REST API 查询这些,但要考虑性能。我也看到了连接 Athena 的建议,但不确定这是否会引入标签和正确的用例。
另一种选择是使用 Dynamo 之类的东西,或者可能是大型 RDS? Redshift 说它是针对 PB 规模的,而我们还没有做到这一点......
对最佳 AWS 存储解决方案的想法?定价是一个考虑因素,但更关注未来的最佳解决方案。
【问题讨论】:
标签: amazon-web-services amazon-s3 amazon-dynamodb amazon-redshift