【发布时间】:2017-08-15 02:33:31
【问题描述】:
我有一个 PDF 文件和大约 130 个 .txt 文件。
PDF 文件没用,需要跳过。每个 .txt 文件都包含名称数据,每个 .txt 文件代表从 1880 年到 2010 年的年份。
所有 .txt 文件的格式都相同:姓名、性别、在特定年份使用该姓名的人数。以下是其中一个 .txt 文件的示例:
Mary,M,8754
Susan,M,5478
Brandy,M,5214
etc...
每个 .txt 文件中可能有数千个名称。我的问题基本上是标题所问的。我想知道如何有效地获取每个 .txt 文件并将它们放入单独但可访问的 DataFrames 中。我希望能够快速搜索并提取特定名称的平均值或标准差等内容。
我已经研究了多个具有类似问题/疑虑的主题,但没有一个对我有任何实际用处:
Import multiple csv files into pandas and concatenate into one DataFrame Read multiple *.txt files into Pandas Dataframe with filename as column header
creating pandas data frame from multiple files
我们不胜感激。
【问题讨论】:
-
文件没有标题?
-
@piRSquared 不,文件没有任何标题
标签: python pandas numpy dataframe