【发布时间】:2020-06-10 16:26:06
【问题描述】:
我正在尝试生成一个 csv。存储两个 .csv 之间的错误百分比。这 。 csv' 具有相同的列数和行数,但由不同的提供者计算。我想检查每个单元格之间的变化(百分比),并将其存储为 . .csv。 以下脚本目前正在运行,但耗时太长:
import pandas as pd
try_1 = pd.read_csv('try.csv', encoding="ISO-8859-1")
test_1 = pd.read_csv('test.csv', encoding="ISO-8859-1")
try_1_df = pd.DataFrame(try_1)
test_1_df = pd.DataFrame(test_1)
results = try_1_df.copy()
percentage = try_1_df.copy()
for col in try_1_df.columns:
for i in range(try_1_df.shape[0]):
if i > 0 and col != 'date':
try:
results.loc[i, col] = float(try_1_df.loc[i, col])-float(try_1_df.loc[i, col])
if float(try_1_df.loc[i, col]) != 0:
percentage.loc[i, col] = (float(results.loc[i, col]) / float(try_1_df.loc[i, col])) * 100
else: percentage.loc[i, col] = 'ok'
except KeyError:
print(col)
percentage.to_csv('percentage_test.csv')
我认为它可以更容易地完成,有人知道如何简化它吗?
.csv' 看起来像:
【问题讨论】:
标签: python pandas dataframe csv compare