【发布时间】:2021-10-21 12:10:01
【问题描述】:
我已经从一个数据框生成了三个输出,我正在尝试通过从每个输出的 1 开始来重置我的句子的标识符 (Sentence_ID)。
输出示例:
Sentence_ID Mention Tag
6388 Chailland B-LOCATION
6388 , O
6388 Mayenne B-LOCATION
6389 poste O
6389 de O
6389 Goumois B-LOCATION
6389 ( I-LOCATION
6389 Doubs I-LOCATION
6389 ) I-LOCATION
6389 . O
6390 Pichet B-PERSON
6390 ( O
6390 veuve O
6390 ) O
6390 , O
6390 de O
6390 Paris B-LOCATION
6390 . O
... continue
预期输出:
Sentence_ID Mention Tag
1 Chailland B-LOCATION
1 , O
1 Mayenne B-LOCATION
2 poste O
2 de O
2 Goumois B-LOCATION
2 ( I-LOCATION
2 Doubs I-LOCATION
2 ) I-LOCATION
2 . O
3 Pichet B-PERSON
3 ( O
3 veuve O
3 ) O
3 , O
3 de O
3 Paris B-LOCATION
3 . O
... continue
我一定是遗漏了一些东西,但不确定是否应该在 Sentence_id 列(通过 group_by())或 reset_index 在此特定列上应用计数器以完成此任务。
如果有人有线索,请提前致谢。
【问题讨论】:
标签: python python-3.x pandas nlp