【发布时间】:2014-06-05 13:56:50
【问题描述】:
我试图通过提供目标页面的 url 来获取页面的标题和元描述数据,但 file_get_html() 总是返回 FALSE 值。 有什么建议?顺便说一句,我启用了 php 扩展 php_openssl。
<?php
include("inc/simple_html_dom.inc.php");
$contents = file_get_html("https://www.facebook.com");
if($contents !=FALSE) //always skips if condition
{
foreach($contents->find('title') as $element)
{
$title = $element->plaintext;
}
foreach($contents->find('meta[description]') as $element)
{
$meta_description = $element->plaintext;
}
$output = array('title'=>$title, 'meta'=> $meta_description);
echo json_encode($output);
}
else
{
echo"Couldn't load contents";
}
?>
更新:
所以 file_get_html() 现在可以正常工作了,但是关于处理 facebook 更新浏览器消息的任何想法?
【问题讨论】:
-
你应该使用 file_get_contents()
-
@BurhanÇetin 感谢您的回复,但这会显示 facebook 的“更新浏览器消息”,我无法获得准确的标题。还有其他建议吗?
-
file_get_html() 不是 PHP 内置函数,因此我们无法判断它返回 FALSE 的原因。 file_get_html() 的源代码是什么?
-
另外,您的网络或系统是否需要代理? PHP默认不使用系统代理,直接尝试连接。
-
@MichaelButler 你好 Micahel 谢谢你的回复,file_get_html() 是 PHP 简单 html dom 解析器的一个函数,我没有使用任何代理服务器,所以我想这不会是与代理。
标签: php simple-html-dom