【发布时间】:2015-03-18 05:44:39
【问题描述】:
我正在尝试使用 python 正则表达式提取文档中出现的所有引用。
我有如下代码,但它不起作用:
import re
hand = open('citi.txt')
for line in hand:
line = line.rstrip()
if re.search('(?:"(.*?)")', line):
print line
【问题讨论】:
-
请定义“不工作”。你观察到什么问题?此代码应打印至少出现两次
'"'的每一行——这 不是 你想要的吗?请举一个小例子说明你想要什么和你得到什么(用玩具大小的city.txt,比如说,三个小线)。 -
我知道你说的是正则表达式,但是...... open('citi.txt').read().replace('"', '') 怎么样?
-
将 if 语句更改为
print re.search(r'(?:"(.*?)")', line).group(1) -
这是来自文件的 sn-p:Citibank, NA(“CBNA”)将在本协议日期或之后,向 HighArc Capital Management, LP(“交易对手”)提供有关以下方面的某些信息可能出售全部或部分特定债务(“贷款”),包括在佛罗里达州迈阿密的 Shore Club 的权益(“信息”和任何此类交易,“交易”)。 -----> 我要提取的是:交易+信息+贷款+交易对手+CBNA