【发布时间】:2017-09-28 03:13:26
【问题描述】:
伙计们。
我在尝试将两个大数据文件合并在一起时遇到了一些独特的问题。两个文件都有一列相同的数据(专利号),而所有其他列都不同。
想法是将它们连接起来,使这些专利号列对齐,以便其他数据可读和连接。
.dat 文件的前几行如下所示:
IL 1 Chicago 10030271 0 3930271
PA 1 Bedford 10156902 0 3930272
MO 1 St. Louis 10112031 0 3930273
IL 1 Chicago 10030276 0 3930276
还有.asc:
02 US corporation No change 11151713 TRANSCO PROD INC 58419
02 US corporation No change 11151720 SECURE TELECOM INC 502530
02 US corporation No change 11151725 SOA SYSTEMS INC 520365
02 US corporation No change 11151738 REVTEK INC 473150
.dat 文件太大而无法在 Excel 中完全打开,所以我认为没有办法重新组织它(我不知道它是否是通过我在网上找到的任何宏)。
我觉得这是一个新手问题,但有谁知道我如何将这些数据集与这个专利号唯一标识符链接在一起(最好使用 Python)?
【问题讨论】:
标签: python excel parsing merge uniqueidentifier