【发布时间】:2014-10-15 15:43:06
【问题描述】:
line = u'in belgi\xeb.'
re.findall('\w+', line, re.UNICODE)
#result: [u'in', u'belgi\xeb']
re.sub('\w+', 'x', line, re.UNICODE)
#result: u'x x\xeb.'
u'\xeb' 是u'ë',如果你有兴趣的话。
所以 findall 似乎将 ë 视为 \w 而不是 sub。
【问题讨论】: