【发布时间】:2021-10-13 06:55:13
【问题描述】:
我有一些 Python 代码,它从 FTP 下载一些文件并将它们写入 AWS S3 存储桶。现在我想避免任何丢失的文件,所以我目前的做法是:
-> 列出 FTP 中所有可用的文件,将文件名添加到列表中list_1
-> 列出 S3 存储桶中的所有文件,将文件名添加到列表中list_2
-> 然后比较list_1和list_2,找出没有下载到s3的丢失文件
-> 下载那些丢失的文件。
问题是这些代码需要每小时运行一次,而且 FTP 中有很多文件,所以第一步(列出 FTP 中的文件名)需要很长时间才能运行(我有一个单独的问题为此:link)。有没有人有其他更好的想法来改进这个逻辑并且执行起来可能更快?
【问题讨论】:
标签: python amazon-web-services amazon-s3 ftp