【问题标题】:XPath to select text containing ® symbol?XPath 选择包含® 符号的文本?
【发布时间】:2019-03-01 21:34:49
【问题描述】:

当符号 ® 出现在 HTML 文档的文本中时,XPath 似乎无法识别它。

.//*[contains(text(), '®')]

.//*[contains(text(), '®')]

.//*[contains(text(), 'U+00AE')]

.//*[contains(text(), '®')]

这些都不会在具有多个 ® 实例的页面上使用 chrome 中的检查器返回结果。

有人遇到过这个问题吗? xpath 如何定位 ® ?

【问题讨论】:

标签: html xml xpath


【解决方案1】:

这个 XPath,

$x("//text()[contains(.,'®')]")

在这个页面上返回7个包含®的文本节点(在我回答之前,就是这样)。

【讨论】:

    【解决方案2】:

    此字符的 Unicode 代码是 x2122,因此如果您想使用数字引用,它应该是 ™™

    代码 xAE 和 174 是 Windows-1252 表示字符的方式;就 XML 和 XPath 而言,这完全无关紧要。

    我不知道你从哪里想到写 U+00AE,这似乎只是一厢情愿。

    当然,XML 文件中的字符可能编码错误。文件中字符实际使用的编码需要与文件开头的XML声明中声明的编码相匹配。

    【讨论】:

    • U+00AE 是 unicode 映射,我当时只是在尝试任何东西,哈哈
    猜你喜欢
    • 2021-10-27
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2019-05-06
    • 1970-01-01
    • 1970-01-01
    • 2020-09-28
    相关资源
    最近更新 更多