【发布时间】:2021-04-06 18:55:13
【问题描述】:
我有一个转换文件的脚本。
import pandas as pd
df = pd.read_csv("sample1.csv")
final_df = df.reindex(['id','name','email'],axis=1)
final_df.to_csv("output.csv", index = False)
sample1.csv
|name|email|id|
|--| -- | -- |
输出.csv
|id|name|email|
|--| -- | -- |
现在,如果其他示例文件的格式如下所示,如何以与 output.csv 相同的格式排列它们
sample2.csv
|id|first name |email address|
|--| -- | -- |
|1 | Sta |sta@example.com|
|2 |Danny|dany@example.com|
|3 |Elle |elle@example.com|
sample3.csv
|id|initial name |email id|
|--| -- | -- |
|1 | Ricky|ricky@example.com|
|2 |Sham|sham@example.com|
|3 |Mark|@example.com|
sample4.csv
| id |alias|contact|
|-- | -- | -- |
| 1 | Ricky|ricky@example.com|
|2 |Sham|sham@example.com|
|3 |Mark|@example.com|
我想转换这些文件并将它们放在输出文件的列中。例如,名字、首字母、别名指的是姓名(都表示相同),而电子邮件地址、电子邮件ID和联系人应指电子邮件。示例文件中的列顺序可以是随机的。
这个案例的基本说明是:
switch(headerfields[i])
{
case "firstname":
case "initial name":
case "alias":
name = i;
}
有在 Pandas 中执行此操作的想法吗?
【问题讨论】:
-
每个数据帧中的顺序是否相同?
-
不,可以不同。实际上,我想创建一个带有新标题的新输出文件,这些字段应该参考。
标签: python python-3.x pandas dataframe numpy