推荐参考资料:
http://www.runoob.com/python/python-reg-expressions.html

详细的总结内容请见我的图文总结(一)文章

这篇文章给出一个实例

# 导入正则表达式的re模块
import re

# 取出string8中所有的天气状态
string8 = "{ymd:'2018-01-01',tianqi:'晴',aqiInfo:'轻度污染'}," \
          "{ymd:'2018-01-02',tianqi:'阴~小雨','aqiInfo':'优'}," \
          "{ymd:'2018-01-03',tianqi:'小雨~中雨',aqiInfo:'优'}," \
          "{ymd:'2018-01-04',tianqi:'中雨~小雨',aqiInfo:'优'}"
# 基于正则表达式使用findall函数
print(re.findall("tianqi:'(.+?)'", string8))

# 取出string9中所有含O字母的单词
string9 = 'Together, we discovered that a free market only thrives when there are rules to ensur '
# 基于正则表达式使用findall函数
print(re.findall('\w*o\w*', string9, flags=re.I))

# 将string10中的标点符号、数字和字母删除
string10 = '据悉,这次发运的400台蒸汽冷凝罐属于国际热核聚变实验堆(ITER)项目的核2级压力设备,' \
           '先后完成了压力试验、真空检验、氦气检漏试验、千斤顶试验等。'
# 基于正则表达式的sub函数
print(re.sub('[,、。a-zA-Z\d()]', '', string10))

# 将string11中的每个子部分内容分割开
string11 = '2室2厅 | 101.62平 | 低区/7层 | 朝南' \
           '上海未来 - 浦东 - 金杨 - 2005年建'
# 基于正则表达式split函数
split = re.split('[-|]', string11)
print(split)
# 分割结果的清洗
split_strip = [i.strip() for i in split]
print(split_strip)

输出结果为:

['晴', '阴~小雨', '小雨~中雨', '中雨~小雨']
['Together', 'discovered', 'only', 'to']
据悉这次发运的台蒸汽冷凝罐属于国际热核聚变实验堆项目的核级压力设备先后完成了压力试验真空检验氦气检漏试验千斤顶试验等
['2室2厅 ', ' 101.62平 ', ' 低区/7层 ', ' 朝南上海未来 ', ' 浦东 ', ' 金杨 ', ' 2005年建']
['2室2厅', '101.62平', '低区/7层', '朝南上海未来', '浦东', '金杨', '2005年建']

正则表达式图文总结(二)
图2 常用正则表达式一览

如有不会的可以在下方评论

相关文章:

  • 2021-09-09
猜你喜欢
  • 2021-07-08
相关资源
相似解决方案