【发布时间】:2016-09-29 00:46:58
【问题描述】:
我有 100 个 csv 文件,每个文件都包含不同机构的出版数据,我想对所有这些文件执行相同的操作:
1.从单元格 B1 中获取机构名称。这总是在“at”或“at the”之后。例如“东北大学的出版物” 2.从另一个名为“代码”的 csv 文件中查找匹配的机构代码。 例如“1286”。 (东北大学)。 3.删除第1-14行(包括B1单元格中的机构名称) 4. 在文件中插入两个额外的列(A 列和 B 列),其标题如下:“Institution”和“InstitutionCode”,并在其中填写我有数据的所有行的相关信息。 (在上面的例子中,东北大学和 1286)。
我是 Python 新手,我发现很难从我找到的资源中整理出这个脚本。 谁能帮帮我?
以下是原始格式的数据图像
下面是所需结果的图片
【问题讨论】:
-
对于初学者,您应该考虑使用名为 Pandas 的 Python 数据分析库。 Here is a link to the tutorials