【发布时间】:2019-06-17 13:52:45
【问题描述】:
我目前正在使用 Selenium 打开和检索 url 列表的页面源。然而,Selenium 对每个 url 花费的时间太长,我计划将此脚本用于(至少)几百个 url。谁能建议一种更快的方法来获取给定 url 的页面源(可能使用 php?)?
请附上您的建议代码。提前致谢。
browser.get(url)
body = browser.page_source
【问题讨论】:
-
@BramVanroy urllib2 是否允许您访问 html 代码以便可以用漂亮的汤来解析它?