【发布时间】:2019-05-31 03:33:26
【问题描述】:
我正在尝试从图像的 srcset 中提取分离的 url。
这用于提取和下载行中存在的所有文件。 我没有硬编码它,因为行有时会有所不同。
txt = "images/1x/1083bce6__color_272x92dp.png 1x, images/2x/b3716cd2_color_272x92dp.png 2x"
reg = re.compile(r"((?:[^\s,]+))(?:.*?,)?").finditer
for i in list(reg(txt)):
print(i.group(1))
我希望结果是两个网址
images/1x/1083bce6__color_272x92dp.png
images/2x/b3716cd2_color_272x92dp.png
但我得到三个额外的存在
2x
【问题讨论】:
标签: python regex string regex-negation regex-greedy