【发布时间】:2021-10-18 15:00:32
【问题描述】:
所以,我有一个包含 .csv 文件的目录。例如:
a.csv
id,name
1,john
2,mary
3,alex
b.csv
id,birth
1,01.01.2001
2,05.06.1990
c.csv
id,death
2,01.02.2020
1,-
结果应该是一个字典,其中键是 id (int),值是文件中所有不同值的字典(字典的字典)。像这样的:
{
1: {"id": 1, "name": "john", "birth": "01.01.2001", "death": -},
2: {"id": 2, "name": "mary", "birth": "05.06.1990",
"death": "01.02.2020"},
3: {"id": 3, "name": "alex", "birth": None, "death": None},
}
到目前为止,我已经尝试将所有文件合并到一个数据框中:
from pathlib import Path
import os
import pandas as pd
files = Path(r'path').rglob('*.csv')
# read in all the csv files
all_csvs = [pd.read_csv(file) for file in files]
# lump into one table
all_csvs = pd.concat(all_csvs, axis=1)
但结果我得到了一个数据框,其中“id”在三列中重复。
任何帮助将不胜感激!
【问题讨论】: