【发布时间】:2019-09-27 07:25:18
【问题描述】:
我每天要添加 200 万个压缩 HTML 文件 (100-150KB),我需要长期存储这些文件。 热数据(70-1.5 亿)被半定期访问,任何比这更早的数据几乎从未被访问过。
这意味着我每天要额外存储 200-300GB 的文件。
现在,标准存储成本为每 GB 0.023 美元,Glacier 为 0.004 美元。
虽然 Glacier 很便宜,但问题是它有额外的成本,所以将 200 万个文件转储到 Glacier 中是个坏主意:
PUT requests to Glacier $0.05 per 1,000 requests
Lifecycle Transition Requests into Glacier $0.05 per 1,000 requests
有没有办法将文件粘合在一起,但可以单独访问它们?
【问题讨论】:
-
存储为单个 ZIP 文件以节省存储空间。访问时,解压缩 ZIP 并提供一个文件
-
@Justinas 这意味着这些文件将无法单独访问。
-
它将通过代理服务
-
无论你最终做什么,如果你创建一个大的存档文件,你最终需要把整个文件从冰川中取出,然后你可以使用字节范围请求来拉下它的一部分。此外,从冰川中检索文件需要时间,在某些情况下需要几个小时。就个人而言,我会研究标准 IA,并创建一个定制的存档格式,该格式在开头有一个带有内容的标头,因此您可以使用字节范围请求来读取标头,然后在知道数据的位置后获取数据。也许将检索的复杂性包装在 Lambda 中,这样客户就不需要知道发生了什么。
-
如您所写,Glacier 的价格为 0.004 美元。但是您不能使用成本低 4 倍(0.00099 美元)的深度存档?
标签: amazon-web-services amazon-s3