【发布时间】:2011-12-14 12:34:00
【问题描述】:
我正在使用 lxml 来解析给定 url 的 html 文件。
例如:
link = 'https://abc.com/def'
htmltree = lxml.html.parse(link)
我的代码在大多数情况下运行良好,http:// 的情况。然而,我发现对于每个https:// url,lxml 都会得到一个IOError。有人知道原因吗?并且可能,如何纠正这个问题?
顺便说一句,鉴于我已经完成了一个快速完成的程序,我想坚持使用 lxml 而不是切换到 BeautifulSoup。
【问题讨论】: