【发布时间】:2021-04-09 07:48:35
【问题描述】:
我有一个现有的数据框,其中每一行代表一个地理点。每个点都由一个唯一的 ID、一个用户定义的序列号及其一对地理坐标定义,如下所示:
id Sequence Latitude Longitude Trajectory
544 0 41.37990 2.17220 1
545 1 41.37874 2.17104 1
546 0 41.37867 2.17092 2
547 1 41.37863 2.17084 2
548 2 41.37857 2.17073 2
549 3 41.37853 2.17065 2
请注意,这些点来自一系列轨迹,其中每个轨迹由序列变量后面的连续点形成。我还有一个现有的变量“轨迹”对这些连续点进行分组。所以,在这个例子中,有一个由两个点组成的轨迹,然后是一个由 4 个点组成的轨迹。
我需要创建一个新的数据框(我们称之为“线”),其中每条线需要一行,连接同一轨迹中的两个连续点。每行需要包含两个点索引及其两对坐标,理想情况下,还需要包含轨迹编号。所以前面例子的结果是:
Line id1 Latitude1 Longitude1 id2 Latitude2 Longitude2 Trajectory
0 544 41.37990 2.17220 545 41.37874 2.17104 1
1 546 41.37867 2.17092 547 41.37863 2.17084 2
2 547 41.37863 2.17084 548 41.37857 2.17073 2
3 548 41.37857 2.17073 549 41.37853 2.17065 2
我一直在尝试使用 tidyverse、dplyr 和类似的库来避免使用 for 循环,因为我知道它们效率不高,并且现有的数据框有数百万个点,但没有任何效果,我找不到任何类似的问题。
欢迎任何有关如何解决该问题的帮助。提前谢谢!
【问题讨论】:
标签: r dataframe sequence point