【发布时间】:2016-02-09 16:16:12
【问题描述】:
当this页面被urllib2抓取时:
url = https://www.geckoboard.com/careers/
response = urllib2.urlopen(url)
content = response.read()
在源代码中找不到以下元素(作业链接)(content)
查看在浏览器中呈现的完整源代码:
因此 FRONT-END ENGINEER 元素似乎是由 Javascript 动态加载的。是否可以让 urllib2 (或其他低级库)在不涉及例如的情况下执行此 Javascript Selenium、BeautifulSoup 还是其他?
【问题讨论】:
-
不,除非你可以在页面 JS 中搜索足够多的内容以找出链接的来源。
标签: python html web-scraping lxml urllib2