【问题标题】:I would like to export DynamoDB Table to S3 bucket in CSV format using Python (Boto3)我想使用 Python (Boto3) 以 CSV 格式将 DynamoDB 表导出到 S3 存储桶
【发布时间】:2020-05-22 01:36:56
【问题描述】:

之前在以下链接中已提出此问题: How to write dynamodb scan data's in CSV and upload to s3 bucket using python?

我已按照 cmets 中的建议修改了代码。代码如下:

import csv
import boto3
import json
dynamodb = boto3.resource('dynamodb')
db = dynamodb.Table('employee_details')
def lambda_handler(event, context):
    AWS_BUCKET_NAME = 'session5cloudfront'
    s3 = boto3.resource('s3')
    bucket = s3.Bucket(AWS_BUCKET_NAME)
    path = '/tmp/' + 'employees.csv'
    try:
        response = db.scan()
        myFile = open(path, 'w')  

        for i in response['Items']:
            csv.register_dialect('myDialect', delimiter=' ', quoting=csv.QUOTE_NONE)
            with myFile:
                writer = csv.writer(myFile, dialect='myDialect')
                writer.writerows(i)
            print(i)
    except :
        print("error")

    bucket.put_object(
        ACL='public-read',
        ContentType='application/csv',
        Key=path,
        # Body=json.dumps(i),
    )
    # print("here")
    body = {
        "uploaded": "true",
        "bucket": AWS_BUCKET_NAME,
        "path": path,
    }
    # print("then here")
    return {
        "statusCode": 200,
        "body": json.dumps(body)
    }

我是新手,请帮助我修复此代码,因为它在将数据插入在 S3 存储桶中创建的文件中时遇到问题。

谢谢

【问题讨论】:

  • 完美,谢谢约翰。它工作顺利

标签: amazon-web-services amazon-s3 aws-lambda amazon-dynamodb boto3


【解决方案1】:

我已将代码修改为更简单,并且还可以处理数据超过 1MB 的表的分页响应:

import csv
import boto3
import json

TABLE_NAME = 'employee_details'
OUTPUT_BUCKET = 'my-bucket'
TEMP_FILENAME = '/tmp/employees.csv'
OUTPUT_KEY = 'employees.csv'

s3_resource = boto3.resource('s3')
dynamodb_resource = boto3.resource('dynamodb')
table = dynamodb_resource.Table(TABLE_NAME)

def lambda_handler(event, context):

    with open(TEMP_FILENAME, 'w') as output_file:
        writer = csv.writer(output_file)
        header = True
        first_page = True

        # Paginate results
        while True:

            # Scan DynamoDB table
            if first_page:
                response = table.scan()
                first_page = False
            else:
                response = table.scan(ExclusiveStartKey = response['LastEvaluatedKey'])

            for item in response['Items']:

                # Write header row?
                if header:
                    writer.writerow(item.keys())
                    header = False

                writer.writerow(item.values())

            # Last page?
            if 'LastEvaluatedKey' not in response:
                break

    # Upload temp file to S3
    s3_resource.Bucket(OUTPUT_BUCKET).upload_file(TEMP_FILENAME, OUTPUT_KEY)

【讨论】:

  • 请注意,截至 2020 年 8 月,此用例(DDB 到 S3)受 AWS 支持,无需编码。更多信息在他们的博客上:aws.amazon.com/blogs/aws/…
猜你喜欢
  • 1970-01-01
  • 2021-11-25
  • 2018-08-28
  • 2022-06-12
  • 2012-03-18
  • 2018-06-02
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
相关资源
最近更新 更多