【发布时间】:2014-07-24 01:50:18
【问题描述】:
我是 PHP 的初学者。我理解这些概念,但正在努力寻找我理解的教程。我的目标是:
- 使用 Firefox 的 xpath 插件来选择我想从网站上抓取的文本片段
- 正确格式化抓取的文本
- 在网站上显示文字
示例)
// Get the HTML Source Code
$url='http://steamcommunity.com/profiles/76561197967713768';
$source = file_get_contents($url);
// DOM document Creation
$doc = new DOMDocument;
$doc->loadHTML($source);
// DOM XPath Creation
$xpath = new DOMXPath($doc);
// Get all events
$username = $xpath->query('//html/body/div[3]/div[1]/div/div/div/div[3]/div[1]');
echo $username;
?>
在这个例子中,我想抓取用户名(在撰写本文时是 mopar410)。
感谢您的帮助 - 我很迷茫 :( 现在我设法在 Google doc 电子表格中使用 xpath 和 importXML 并且有效,但我希望能够在我自己的网站上使用 PHP 来学习如何。
这是我在网上找到并编辑了 URL 和变量的代码 - 因为我自己不知道如何编写。
【问题讨论】:
-
这里似乎没有问题
-
嗨菲尔,对不起 - 似乎没有收到关于评论更新的通知。我的问题是,我很难找到一个最简单的合适教程......只是使用 php/xpath 抓取文本并在网站上显示该文本的基础知识。我找到了很多教程,但其中很多只是部分教程。上面的代码是我从众多来源汇总的,但它似乎不起作用。
标签: php xpath web-scraping domxpath