【发布时间】:2017-09-29 22:12:42
【问题描述】:
我收到了来自图书馆目录的数据转储,它以 .txt 格式输出。我已经能够将数据放入电子表格中,但它都在一个列中。我会将行转换为列。
这一列中的数据按以下顺序排列: 标题 文件类型 作者 日期
但在某些情况下,目录记录按顺序显示: 标题 文件类型 概要 作者 日期
因此,我无法根据行数将这些记录转换为列。
每个标题前面都有“描述”一词。这是整个数据集中的一个常规特征。
有没有办法使用 OpenRefine 根据列中的文本将行转换为列?要在包含“Description”的行之后转置 x 行,直到出现单词“Description”的下一个实例?
【问题讨论】:
-
您能否提供一个最小的数据样本,我们可以直接将其导入 Open Refine 以进行一些测试?
-
嗨@phillip。如果欧文的回答是对的,而且我认为是对的,你能接受吗?谢谢!
标签: openrefine