【发布时间】:2020-11-05 08:56:48
【问题描述】:
我正在尝试解析 HTML 以提取此正则表达式构造中的所有值: href="http//.+?"
这是代码:
import urllib.request
import re
url = input('Enter - ')
html = urllib.request.urlopen(url).read()
links = re.findall('href="(http://.*?)"',html)
for link in links:
print(link)
但我收到一条错误消息: TypeError: 不能在类似字节的对象上使用字符串模式
【问题讨论】:
标签: python regex html-parsing urllib