【发布时间】:2018-11-19 06:39:03
【问题描述】:
假设我有数据框 df1,其中包括两列 - A 和 B。A 的值代表下限,B 的值代表上限。
A B
10.5 20.5
30.5 40.5
50.5 60.5
我有另一个数据框,其中包含两列 - C 和 D 包含不同范围的数字。
C D
12.34 15.90
13.68 19.13
33.5 35.60
35.12 38.76
50.6 59.1
现在我想列出 df2 中属于 df1 中的组(在下限和上限之间)的所有对。
最终输出应该是这样的 -
Key Values
(10.5, 20.5) [(12.34, 15.90), (13.68, 19.13)]
(30.5, 40.5) [(33.5, 35.60), (35.12, 38.76)]
(50.5, 60.5) [(50.6, 59.1)]
该解决方案应该是有效的,因为我有 5000 组范围和来自不同范围的 85000 个数字。
【问题讨论】:
-
这段代码应该对性能有多重要? “高效”是什么意思?
标签: python performance pandas data-science