【发布时间】:2020-06-04 02:48:41
【问题描述】:
我正在使用 .feature_importances_ 将重要性值从回归树模型导出到 CSV。该树使用不同数量的变量多次运行。我希望添加一个额外的列,列出计算重要性时使用的变量数量。
目前我可以使用下面的代码将重要性值和变量名导出到 CSV
Importance = list(zip(model.feature_importances_,list(X)))
Importance = pd.DataFrame(Importance,columns=["Importance","Feature_Name"])
Importance.to_csv('File.csv', mode='a', header=False)
我得到一个看起来像这样的 CSV
Imp VarName
0 1.00 0mm
0 0.58 0mm
1 0.42 0.63mm
0 0.54 0.63mm
1 0.36 0mm
2 0.10 0.125mm
我正在寻找的是添加第四列,其中包含该树中使用的变量数量,因此输出将是这样的
Imp VarName NumVar
0 1.00 0mm 1
0 0.58 0mm 2
1 0.42 0.63mm 2
0 0.54 0.63mm 3
1 0.36 0mm 3
2 0.10 0.125mm 3
【问题讨论】:
标签: python regression export-to-csv decision-tree