【发布时间】:2015-07-11 13:06:50
【问题描述】:
如何抓取那里的所有数据?我正在编写一个 php 脚本来从具有动态加载程序的网站上抓取数据。我正在使用 HTML Dom 解析器和 scoopy 来抓取以下网站 https://www.lyoness.com/au/search/partner/ 。 我是初学者,我无法确定如何解析无限滚动。
<input id="btnNextPage" type="button" class="btn btn-primary" style="width: 100%" value="Next page">
【问题讨论】:
-
您需要在您的浏览器中调试它,以了解如何以及从何处获取无关内容。很可能它通常只是一个
$.load("url #div")摘录,有时是一个不同的寻呼地址,甚至是 JSON。 -
@mario 我如何解析你能给我任何例子或参考。 ?
-
你为什么不先用一个例子来具体化你的问题呢?
-
我已经添加了网站的链接希望你能理解我的问题
-
是的,很容易看到它通过 Firebug 或 Developer Tools 或 Dragonfly 加载了额外的资源。它会轮询
GET /au/search/loadpage?cp=0&area=2&st=&rz=&rzc=&f=&ft=Basic&…………以获取更多 HTML 内容。现在,该 URL 的构造方式取决于 JavaScript 实现。要求太宽泛了。你必须自己弄清楚这一点。 (毕竟这是你的抓取项目。)
标签: php web-scraping infinite-scroll