【发布时间】:2019-01-24 01:24:40
【问题描述】:
我有一个相当大的数据框(500k+ 行),我正在尝试将其加载到 Vertica。我有以下代码工作,但它非常慢。
#convert df to list format
lists = output_final.values.tolist()
#make insert string
insert_qry = " INSERT INTO SCHEMA.TABLE(DATE,ID, SCORE) VALUES (%s,%s,%s) "
# load into database
for i in range(len(lists)):
cur.execute(insert_qry, lists[i])
conn_info.commit()
我看到一些帖子谈论使用 COPY 而不是 EXECUTE 来完成如此大的负载,但还没有找到一个好的工作示例。
【问题讨论】: