【发布时间】:2018-12-19 02:48:49
【问题描述】:
例如,假设我有两个这样的数据关系:
Data1:
C1 C2
"Peter" "kiwi"
"John" "banana"
"Susan" "peach"
"Joe" "apple"
Data2:
C3 C4
"apple" 4
"banana" 7
"apple" 4
对于 data1 中的每一行,我想找到公共属性上的所有可能匹配项(比如在 Data1[C2] 和 Data2[C3] 之间),并对找到的所有匹配项的 Data2[C4] 值求和。
更具体地说,我希望得到的计算结果如下:
"Peter": 0 (no match for "kiwi")
"John": 7 (one match for "banana", it's just 7)
"Susan": 0 (no match for "peach")
"Joe": 8 (two matches for "apple", they're 4+4)
如何使用 pandas 数据框或 numpy 高效地完成此任务?
非常感谢您的帮助。在获得有关此问题所涉及的技术细节的更多信息后,我将编辑问题标题以使其更具相关性。
【问题讨论】: