【发布时间】:2017-06-27 23:56:32
【问题描述】:
我打印了列变量的摘要,如下所示:
summary(document$subject)
A,B,C,D,E,F,.. 是属于 data.frame 列的主题,其中 A,B,C,... 在列中出现多次,上面的摘要显示这些主题在文件中出现的次数(频率)。另外,“其他”一词是指那些在文件中只出现过一次的主题,我还需要为这些主题分配“1”。
有这么多不同的主题,如果我们使用命令“c”,很难一一列出。
我想建立一个新列(或 data.frame),然后将这些相应的数字(分数)分配给主题。理想情况下,它会在文件中变成这样:
A 198
B 113
C 96
D 69
A 198
E 65
F 62
A 198
C 113
BZ 21
BC 1
CJ 1
...
我想知道应该使用什么命令从汇总表中获取分数/值,然后构建一个新列以将这些值分配给文件中的相应主题。
另外,由于是R打印的汇总表,我不知道如何将其构建到文件中的表格中,或者从表格中取出值和主题名称。我还想知道如何找出在文件中只出现一次的主题名称,以便汇总表将它们添加到“其他”中。
【问题讨论】:
标签: r