【发布时间】:2016-06-15 14:26:53
【问题描述】:
我可以单独访问以下每个 URL:http://www.example.com/{.*}.html
但是,对主页 http://www.example.com 的访问受到某种限制,我被重定向到显示错误页面:Erreur 403 - Refus de traitement de la requête (Interdit - Forbidden)。
有没有办法列出该域下托管的 HTML 页面的所有 URL?
【问题讨论】:
标签: python url web-crawler