【问题标题】:xpath get html for persian charsxpath获取波斯字符的html
【发布时间】:2014-02-17 15:08:42
【问题描述】:

我用这种方法得到波斯网页的内部 html:

private static function getInnerHTML($node)
{
    $innerHTML = "";
    $children = $node->childNodes;
    foreach ($children as $child) {
        $tmp_doc = new DOMDocument();
        $tmp_doc->appendChild($tmp_doc->importNode($child,true));
        $innerHTML .= $tmp_doc->saveHTML();
    }
    return $innerHTML;
}

当我在浏览器中看到源代码时,我发现波斯字符如下:

گزارش

如何将此编码转换为常规波斯字符?

例如,这个字符必须是: گزارش

对不起,我不知道这个编码是什么,所以之前无法搜索。

谢谢。

【问题讨论】:

  • 试试$innerHTML .= html_entity_decode($tmp_doc->saveHTML());
  • @Rikesh:是的,非常感谢

标签: php xpath unicode persian


【解决方案1】:

根据我的评论,您需要的是html_entity_decode

$innerHTML .= html_entity_decode($tmp_doc->saveHTML());

DEMO.

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 2019-03-31
    • 2011-11-04
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2015-05-11
    • 1970-01-01
    相关资源
    最近更新 更多