【发布时间】:2015-12-24 03:02:55
【问题描述】:
我正在尝试使用 Python 的分区和正则表达式来清理文本字符串。例如:
testString = 'Tre Bröders Väg 6 2tr'
sep = '[0-9]tr'
head,sep,tail = testString.partition(sep)
head
>>>'Tre Br\xc3\xb6ders V\xc3\xa4g 6 2tr'
头部仍然包含我要删除的 2tr。我不太擅长正则表达式,但 [0-9] 不应该这样做吗?
我希望从这个例子中得到的输出是
head
>>> 'Tre Br\xc3\xb6ders V\xc3\xa4g 6
【问题讨论】:
-
你期望输出什么?
-
你甚至没有在这里使用正则表达式,那为什么
[0-9]会这样做呢? -
添加了我期望的输出
-
@AshwiniChaudhary,为什么我不使用正则表达式?有什么特别需要我补充的吗?我正在使用这个备忘单:cheatography.com/davechild/cheat-sheets/regular-expressions
-
你只想要头部?