【问题标题】:simple html php dom parser a way to gather information from all pages?简单的 html php dom 解析器一种从所有页面收集信息的方法?
【发布时间】:2013-02-10 06:01:49
【问题描述】:

我想知道是否有可能使此代码搜索该网站的每个页面,以便从所有页面中提取每个图像 src。目前它只会从那一页中提取图像 src。我尝试使用 while 循环,但它只会一遍又一遍地重复主页上的相同结果。任何帮助都会很棒。

<?php
include_once('simple_html_dom.php');

//show errors
ini_set('display_errors', true);
error_reporting(E_ALL);


$html = file_get_html('http://betatv.net/');
$result=($html);
while($html = ($result)) {

// find the show img and echo it out
foreach($html->find('.entry-content') as $cover_img)
foreach($cover_img->find('img') as $cover_img_link)

//echo the images src
echo $cover_img_link->src .'<br>';
echo '<br>';

}
// clean up memory
$html->clear();
unset($html);

?>

证明我拥有 betatv.net 我在首页添加了指向此问题的链接。

【问题讨论】:

  • betatv.net 中奖了吗?如果没有,您可能不应该这样做;而且您需要一个非常复杂的脚本才能在您不拥有的服务器上执行此操作。如果你这样做,请更新你的问题,这样说(如果你“拥有”服务器,执行你所要求的脚本将非常相似)。
  • 是的,我拥有 betatv.net。
  • 我在首页添加了这个问题的链接作为证据。
  • 有人吗?真的可以在这方面使用一些帮助。
  • 我目前正在解决另一个用户的问题,但是为了让您朝着正确的方向开始,请查看 PHP 的 glob 函数 (php.net/manual/en/function.glob .php)。您将需要打开每个文本文件并将其传递到上面的脚本中。另外,考虑到现在是北美和欧洲的凌晨。

标签: php html parsing dom


【解决方案1】:

这是一个很好的页面爬虫示例:

How do I make a simple crawler in PHP?

您只需为找到的每个链接使用您的代码。

此外,如果您拥有此页面,我敢打赌有更好的方法来查找所有图像,而不是从前端抓取它。

【讨论】:

  • 谢谢我想通了。我知道我可以更容易地获得链接,但我正在尝试使用 php 进行学习。这很有趣,因为我使用相同的链接来找到我的答案,只是我从谷歌找到了它。下次我会确保在提出新问题之前进行更多搜索。
猜你喜欢
  • 2012-08-19
  • 2019-12-24
  • 2012-01-17
  • 1970-01-01
  • 1970-01-01
  • 2017-09-09
  • 2015-02-14
  • 1970-01-01
相关资源
最近更新 更多