【问题标题】:How to load data from your S3 bucket to Sagemaker jupyter notebook to train the model?如何将 S3 存储桶中的数据加载到 Sagemaker jupyter notebook 以训练模型?
【发布时间】:2019-04-28 23:24:05
【问题描述】:
我在 S3 存储桶中有 csv 文件,我想用这些文件在 sagemaker 中训练模型。
使用此代码,但出现错误(未找到文件)
import boto3
import pandas as pd
region = boto3.Session().region_name
train_data_location = 's3://taggingu-{}/train.csv'.format(region)
df=pd.read_csv(train_data_location, header = None)
print df.head
有什么办法可以解决这个问题?
【问题讨论】:
标签:
pandas
amazon-web-services
amazon-s3
amazon-sagemaker
【解决方案1】:
不确定,但这个 stackoverflow 可以回答吗? Load S3 Data into AWS SageMaker Notebook
引用@Chhoser:
import boto3
import pandas as pd
from sagemaker import get_execution_role
role = get_execution_role()
bucket='my-bucket'
data_key = 'train.csv'
data_location = 's3://{}/{}'.format(bucket, data_key)
pd.read_csv(data_location)