【发布时间】:2019-03-01 21:28:52
【问题描述】:
我在一个目录中有几千个 .txt 文件,我想将它们全部读入 tidytext 中,然后在其中添加元数据列。文件名本身包含所有元数据,我已经成功地使用 substr 来解析一个文件的不同部分的位置、时间、日期等,但我找不到一个示例来说明如何继续为所有人执行此操作目录中的文件。
例如,我有 .txt 文件:
FFTJan141138
FFTJan151136
FFTJan161151
FFTJan171144
我已使用以下方法将文件从我的 wd 读取到 tibble 中:
tbl <- list.files(pattern = "*.txt") %>%
map_chr(~ read_file(.)) %>%
data_frame(text = .)
我需要帮助的是插入一些与文件名中的元数据相对应的数据列。
例如,对于名为:FFTJan141138 的第一个文件 我现在有了这个文件的 tibble 行,其中有一列是 FFTJan141138 的内容。我想在这一行中添加四个额外的列,包括 FFT、JAN、14 和 1138。 我可以使用 substr 解析文件名中的文本,但不知道如何执行此操作,因为数据已读入 tidytext。任何帮助将不胜感激。
谢谢。
【问题讨论】:
标签: tidytext