【发布时间】:2012-11-25 03:27:54
【问题描述】:
<?
$file = "http://www.google.com";
$doc = new DOMDocument();
echo @$doc->loadHTML(file_get_contents($file));
$element = $doc->getElementsbyTagName('span');
echo trim($element->item(0)->nodeValue);
echo trim($element->item(0)->textContent);
if (!is_null($element)) {
$content = $element->nodeValue;
if (empty($content)) {
$content = $element->textContent;
}
echo $content . "\n";
}
?>
我正在尝试测试这个脚本,我想知道为什么我不能解析谷歌?如果您查看源页面,在 span 中按 ctrl+f 类型,显然有一个 span 标签。为什么不给我结果?
【问题讨论】:
-
你试过在 DOMDocument 中输出 HTML 吗?
var_dump($doc->saveHTML());看看它是否包含您认为它包含的内容? -
你试过买晚餐了吗??
-
@RutgersMike,我想知道是否有人会就标题发表评论。
-
@davidethell 通常“不”表示“不”=oP
标签: php parsing screen-scraping