【发布时间】:2018-04-01 23:09:46
【问题描述】:
我在 Python 中有一个名为 df1 的数据框,如下所示:
SYMBOL prediction_succesful DATE VALUE
0 ABC Y 29-03-2018 100
1 DEF Y 30-03-2018 96
2 GHI Y 01-04-2018 105
3 ABC NaN 30-03-2018 55
我想创建另一个名为 df3 的数据框,其中包含 3 个名为 symbol、no_of_predictions 和 no_of_succesful_predictions 的列 其中 no_of_predictions 包含每个值在符号列中重复的次数,no_of_successful_predictions 包含 prediction_succesful 中的值是 Y 的次数 我尝试了以下代码,但它不起作用:
df3 = DataFrame(columns =['symbol','no_of_predictions','no_of_successful_predictions'])
for i in unique_symbols:
counter = 0
counter2 = 0
for j in df1:
mask = df1[j].symbol == i
if mask:
counter += 1
mask2 = df1[j].prediction_succesful
if mask2 == "Y":
counter2 += 1
df3.append(['symbol'=i,'no_of_predictions' = counter,'no_of_successful_predictions' = counter2])
这里 df1 是我正在处理的主要数据框
而 unique_symbols 是一个包含 df1 数据框中所有唯一符号的列表,例如 unique_symbols = ['ABC','DEF','GHI']
一些帮助将不胜感激
【问题讨论】:
标签: python pandas dataframe data-analysis