【发布时间】:2017-11-30 02:40:11
【问题描述】:
我正在与我的团队一起开展一个学校项目,我们必须使用 Python 分析大型数据集。数据采用图像(jpeg 文件)的形式。由于分析涉及图像,我们将使用 TensorFlow、OpenCV 等。由于数据集很大,我们正在探索在 EC2 上运行 Python 并将数据集存储在 S3 上。是否有任何 wiki 或指南可以帮助我们: 1) 在 EC2 上设置 Python (3.5) 并连接到存储文件的 S3 存储桶。 2) 创建一个多用户环境,所有团队成员(五名)都可以远程访问服务器并针对数据集/文件运行测试。 我在 AWS 上的技能水平充其量是基本的。非常感谢您对此提供的任何帮助。
【问题讨论】:
-
使用 awscli (docs.aws.amazon.com/cli/latest/userguide/installing.html) 从/复制到 S3
标签: python-3.x amazon-s3 amazon-ec2 jupyter-notebook