【发布时间】:2020-01-10 01:00:17
【问题描述】:
我有 2 个数据集,其中一个具有不同的行数和列数,但有共同的 id。
问题:我希望将两个数据框组合成一个新的数据框,该数据框具有相同的 df1 行数,但添加了额外的 Age 列,age 列中的值根据 id 填充
例子:
data = [[1,'Alex',10],[2,'Bob',12],[3,'Clarke',13],[1,'Alex',13],[4,'Jim',13], [3,'Clarke',13]]
df1 = pd.DataFrame(data,columns=['id', 'Name','Score'],dtype=int)
data2 = [[1, 20],[2, 22],[3, 19],[4, 21]]
df2 = pd.DataFrame(data2,columns=['id','Age'],dtype=int)
输出:
不知道从哪里开始
python新手,请帮忙!
预期输出:
id Name Score Age
0 1 Alex 10 20
1 2 Bob 12 22
2 3 Clarke 13 19
3 1 Alex 13 20
4 4 Jim 13 21
5 3 Clarke 13 19
【问题讨论】:
-
No clue where to start- Pandas docs,Getting Started, User Guide, Tutorials 非常好,是一个很好的起点。甚至还有videos。
标签: python pandas csv jupyter-notebook