【发布时间】:2021-07-21 21:42:16
【问题描述】:
我有一个 Lambda 函数,它执行 Athena 查询并将 csv 文件中的输出导出到 S3 存储桶。 现在在我的 S3 存储桶中,我得到了 2 个文件 .csv 和 .csv.metadata
我的问题是如何排除 .csv.metadata 文件?
import boto3
def lambda_handler(event, context):
query_1 = "<MY-QUERY-HERE>"
database = "<MY-DB-HERE>"
s3_output = "MY-S3-BUCKET"
client = boto3.client('athena')
response = client.start_query_execution(QueryString = query_1,
QueryExecutionContext={
'Database': database
},
ResultConfiguration={
'OutputLocation': '<MY-S3-BUCKET>'
}
)
return response
【问题讨论】:
-
您打算在运行查询后如何使用 .csv 文件?根据这一点,我可以提供一些建议
-
是的,我将使用我想要排除的 .csv 文件和 .csv.metadata。
-
如果您使用的是 Athena,您只需在 lambda 中添加一行,即可重命名以下划线/点 (_/.) 开头的这些 *.metadata 文件。这将从 Athena 隐藏元数据文件。
-
抱歉,我不明白我需要添加什么以及在哪里添加,是的,我在 Lambda 函数中使用 Athena 查询,正如您在代码中看到的那样。
标签: python amazon-web-services aws-lambda amazon-athena