【发布时间】:2013-12-30 00:46:29
【问题描述】:
作为我们项目的一部分,我们在 S3 上创建了一个相当茂密的文件夹/文件树,所有文件占用了大约 6TB 的数据。我们目前没有这些数据的备份,这是不好的。我们想做定期备份。似乎冰川是要走的路。
问题是:有哪些方法可以降低备份的总成本?
我们的大部分文件都是文本,因此我们可以压缩它们并上传整个 ZIP 档案。这将需要处理(在 EC2 上),所以我很好奇是否有任何经验法则可以比较运行 EC2 实例进行压缩与仅上传未压缩文件的额外成本。
另外,我们必须为数据传输付费,所以我想知道除了 (i) 从 S3 下载文件到实例之外,是否还有其他备份方式; (ii) 以原始格式上传文件或压缩到 Glacier。
【问题讨论】:
-
我们终于厌倦了处理从 Glacier 恢复的长延迟(通常为 3-5 小时)以及隐藏的成本因素。我们最终创建了一个程序来同步和创建我的存储桶的快照,其中包括使用 S3 减少冗余存储来更好地接近 Glacier 的成本节约优势。在过去的几年里,它对我们来说效果很好,所以我们最终把它变成了商业产品。您可以在BucketBacker 上免费试用全功能的 2 周试用版
标签: amazon-s3 amazon-ec2 amazon-glacier