【发布时间】:2019-09-27 03:30:52
【问题描述】:
我已经解析了一个语料库,我现在有这样的东西,来自 text1:
doc_id sentence_id token_id token lemma pos entity
1 text1 1 1 Introductory introductory ADJ
2 text1 1 2 statement statement NOUN
3 text1 1 3 with with ADP
4 text1 1 4 Q&A Q&A PROPN ORG_B
5 text1 1 5 \n \n SPACE
6 text1 1 6 Jean Jean PROPN PERSON_B
到 text100
doc_id sentence_id token_id token lemma pos entity
758712 text100 273 32 task task NOUN
758713 text100 273 33 . . PUNCT
758714 text100 273 34 SPACE
758715 text100 274 1 Thank thank VERB
758716 text100 274 2 you -PRON- PRON
758717 text100 274 3 . . PUNCT
现在,我正在尝试更改 doc_id 列的每个元素,以便只要有 text1,它就会出现 text134,只要有是text2就会出现text135等等(基本上从1-100到134-233)。
我只是使用以下代码为 text1 做的:
parse2 %>% mutate(doc_id = recode(doc_id, text1 = "text134"))
如何将相同的逻辑应用于从 1 到 100 的每个文本?试图创建一些循环,但我对 R 很陌生,我只是坚持下去。
你能帮帮我吗?
非常感谢!
【问题讨论】: