【发布时间】:2017-05-20 23:52:36
【问题描述】:
我有一个作为网络蜘蛛运行的 Python (3.6) 脚本。它抓取页面的内容,提取链接并抓取它们。它使用lxml.html 处理链接,使用导入
from lxml import html
我正在尝试为运行时可能遇到的每个错误创建自定义响应。我目前正在处理 Unicode、SSL、重定向、连接和 ContentDecode 错误。我经常遇到lxml.etree.XMLSyntaxError 和lxml.etree.XMLParseError。我尝试通过 except-blocks 传递它们,但是当它遇到NameError: name 'lxml' is not defined 时它总是停止,因为我只导入lxml.html 而不是整个模块。
有什么方法可以在不导入整个模块的情况下捕获错误?
【问题讨论】:
标签: python error-handling lxml lxml.html