【发布时间】:2017-10-22 09:05:17
【问题描述】:
所以我有一个相当古老的原始数据,如下所示:
1
*******
*******
*******
*******
S H
HHHHH
2
*******
JSH K
*******
*******
*******
*******
第一行有一个数字1,这是一个ID。下面的 2~7 行每行应该有 7 个元素,对应 7 个类别,比如 a1,a2,a3,a4,a5,a6,a7。第 8 行又是一个 ID。因此,对于每个人,我们有 6 行。
归根结底,我想要一个像这样的输出
ID a1 a2 a3 a4 a5 a6 a7
1 1 * * * * * * *
2 1 * * * * * * *
3 1 * * * * * * *
4 1 * * * * * * *
5 1 <NA> <NA> S <NA> <NA> H <NA>
6 1 <NA> H H H H H <NA>
7 2 * * * * * * *
8 2 J S H <NA> <NA> <NA> K
9 2 * * * * * * *
10 2 * * * * * * *
11 2 * * * * * * *
12 2 * * * * * * *
数据没有任何文件扩展名(如 .csv 或 .txt)。所以第一个问题是如何在R中读取它同时保持数据格式不变。
我尝试使用read.csv(),但它会使第6行变成
SH
将 S 分配到第 1 类而不是第 3 类,将 H 分配到第 2 类而不是第 6 类。最终,我如何生成所需的数据框?
【问题讨论】: