【发布时间】:2018-03-28 19:36:08
【问题描述】:
我正在处理来自药品标签的数据。文本始终使用动词短语“indicated for”来构建。
例如:
sentence = "Meloxicam tablet is indicated for relief of the signs and symptoms of osteoarthritis and rheumatoid arthritis"
我已经使用 SpaCy 过滤到仅包含短语“indicated for”的句子。
我现在需要一个函数来接收句子,并返回作为“indicated for”对象的短语。所以对于这个例子,我称之为extract()的函数将像这样运行:
extract(sentence)
>> 'relief of the signs and symptoms of osteoarthritis and rheumatoid arthritis'
有没有使用 spacy 的功能?
编辑: 简单地在 'indicated for' 之后拆分不适用于复杂的示例。
这里有一些例子:
'''丁丙诺啡和纳洛酮舌下片适用于阿片类药物依赖的维持治疗,应作为完整治疗计划的一部分,包括咨询和社会心理支持丁丙诺啡和纳洛酮舌下片含有丁丙诺啡是阿片类药物的部分激动剂,纳洛酮是阿片类药物的拮抗剂,适用于阿片类药物依赖的维持治疗'''
'''氧氟沙星滴眼液适用于治疗下列细菌敏感菌株引起的感染 结膜炎 革兰氏阳性菌 革兰氏阴性菌 金黄色葡萄球菌 表皮葡萄球菌 肺炎链球菌 肠杆菌阴沟杆菌 流感嗜血杆菌 奇异变形杆菌 绿脓杆菌 角膜溃疡 革兰氏阳性菌 革兰氏阴性菌 金黄色葡萄球菌 表皮葡萄球菌 肺炎链球菌 绿脓杆菌 粘质沙雷氏菌'''''''
我只想要粗体部分。
【问题讨论】:
-
你能给出更多的段落或变体吗?