【发布时间】:2018-07-04 14:40:27
【问题描述】:
我正在尝试使用 Python、Selenium 和 Firefox 从网站获取图像 URL,但我似乎面临这种情况,但这是不可能的?没有元素,但显示图像。当我在 Firefox 中使用“检查”时,它会建议以下图像元素,但是我在其中看不到任何有关图像源的信息:
<canvas width="575" height="575" id="orbitvu-2154214-obj-canvas" class="orbitvu-viewer-object-canvas zindexer" style="margin: 0px; padding: 0px; box-sizing: border-box; line-height: 0; width: 100%; height: 100%; display: block; background-color: rgb(255, 255, 255); opacity: 1;"></canvas>
我还可以看到,firefox 在下载网站时会下载图像,并且图像下载是由网站中嵌入的 js 脚本触发的。所以我假设这个脚本在这里做了一些魔法——它下载图像并以某种方式让浏览器显示它,而最终的 HTML 源代码中没有任何东西可用于识别图像源位置。 我想知道是否存在根本无法抓取日期的情况,也许这就是其中之一?
【问题讨论】:
标签: javascript python html selenium web-scraping