【发布时间】:2010-09-15 21:34:14
【问题描述】:
我正在编写一段代码,该代码应该获取给定 html 文档的特定 html 标记的内容。
$html = "<html>..........truncated.........<div>blablabla<br />xy</div>.....";
$dom = new DomDocument();
$dom->loadHTML($html);
$divs = $dom->getElementsByTagName('div');
echo $divs->item(0)->nodeValue.'<br>';
html 代码只是一个示例,但显示了我遇到的问题:我想获取此 DIV 的内容,并且我需要保留内部标签!
nodeValue(以及“textContent”)的作用是返回正确节点with all inner tags stripped(http://docs.php.net/manual/en/class.domnode.php)的内容
我不知道如何获得正确的atm ...我需要的是相当于javascripts“innerHTML”左右...但我找不到这样的方法:(
我怎样才能做到这一点?
【问题讨论】:
标签: php dom html-parsing