【发布时间】:2016-07-29 02:57:21
【问题描述】:
我正在将大量数据 (link to data) 下载到 AWS Ubuntu 服务器,希望最终将数据保存到已安装的 S3 存储桶中。问题是,如果我要使用 200GB 磁盘将所有数据(例如 >1TB 的数据)下载到 AWS Ubuntu 服务器,则会超出磁盘的限制。因此,在这些限制条件下,如何有效地将数据传输到 S3 存储桶?
我考虑过将单个文件下载到磁盘,同步到 S3,然后删除文件,尽管这种方法似乎效率极低。
【问题讨论】:
-
为什么不能直接上传到S3?为什么是中间 Ubuntu 服务器?
-
据我所知直接上传到 S3 是不可能的。
-
为什么说不能直接上传到 S3?我每天都这样做......
-
here 是 Java api- 从这里你可以找到包括命令行在内的其他 API。
-
在 EC2 存在之前就可以直接上传到 S3。您也可以使用 awscli 来完成。
标签: linux shell amazon-web-services amazon-s3 ubuntu-server