【发布时间】:2017-12-10 04:07:34
【问题描述】:
我在运行 Spyder3 的 Python 3 Anaconda 中有如下巨大的文本字符串:
search="germany"
text = "germany's gabriel denies report he is eyeing finmin post
berlin (reuters) - german foreign minister sigmar gabriel on saturday denied
a report that said the social democrat, whose party has agreed to enter
talks with chancellor angela merkel's conservatives on forming a coalition,
was eyeing the post of finance minister.
13.5 hours ago
— reuters
iit-kharagpur gets over 1,000 placement offers in eight days
quantiphi analytics emerged as the largest recruiter of the season till date
offering 34 jobs, followed by intel at 33
13.5 hours ago
— business standard"
我可以使用以下条件在文本中进行搜索:
if search in text:
print("Found")
else:
print("Not Found")
但我真正需要的是获取所有与让我们说“德国”相关的新闻文本,从“德国的 gabriel 否认报告......”一直到“财政部长的职位”,以防在文本中发现德国.
关于如何完成这一壮举有什么想法吗? 提前一千感谢您的所有回答。
【问题讨论】:
-
将其重述为“我需要获取文本中出现
Germany的每一段”是否正确?如果是这样,也许您可以将字符串拆分为"\n\n"并获取匹配的元素?或下面基于正则表达式的答案。