【发布时间】:2011-07-06 01:21:37
【问题描述】:
我想用 php 制作一个简单的爬虫,它可以让我获取网页中的链接,回显它们的 url,然后爬到其他页面以在某个域下执行相同的操作。这里需要使用 cURL 吗?另外..如何指定爬虫的深度。
到目前为止我有这个:
$dom = new DOMDocument;
$dom->loadHTML($html);
foreach( $dom->getElementsByTagName('a') as $node ) {
echo $dom->saveXml($node), PHP_EOL;
}
【问题讨论】:
-
如果唯一的问题是“使用或不使用 CURL” - 那么答案是“是的,使用它”
-
好吧,我也想知道如何做到这一点...我对 cURL 还很陌生...而且我一直在环顾四周
-
我想我会补充一点,您可能会遇到 PHP 超时限制
标签: php