【发布时间】:2018-05-12 05:32:59
【问题描述】:
我正在编写一个将大量数据写入.csv 文件的脚本。为了使感兴趣的用户之间的数据传输更容易,我想对每个文件的行数进行限制。例如,我希望将第一百万条记录写入some_csv_file_1.csv,将第二百万条记录写入some_csv_file_2.csv,依此类推,直到所有记录都写入为止。
我试图让以下工作:
import csv
csv_record_counter = 1
csv_file_counter = 1
while csv_record_counter <= 1000000:
with open('some_csv_file_' + str(csv_file_counter) + '.csv', 'w') as csvfile:
output_writer = csv.writer(csvfile, lineterminator = "\n")
output_writer.writerow(['record'])
csv_record_counter += 1
while not csv_record_counter <= 1000000:
csv_record_counter = 1
csv_file_counter += 1
问题:当记录增加到超过 1000000 时,不会创建后续文件。该脚本继续将记录添加到原始文件中。
【问题讨论】:
-
你试过用羽毛包吗?
-
我没听说过羽毛
-
['record'] 来自哪里?它看起来像什么 [['record'], .....]?
-
每条记录都是从包含千万条记录的数据流中获取的。