【发布时间】:2017-08-18 19:39:04
【问题描述】:
我正在为 html 页面使用 UTF-8 编码。
<head>
<meta charset="utf-8">
在调试器控制台中,document.characterSet 返回“UTF-8”。
在页面上,我的元数据(关键字、描述、标题)具有有效的 UTF-8 字符:'®',即 UTF-8:'c2ae'
字符在视图源和页面标题中正确显示。
但谷歌搜索结果和必应搜索结果将其显示为“î”。也就是说,在网络抓取期间,它似乎正在转换为 ISO-8859-1 或 Western-1252,同时显示两个字节:“c2”和“ae”。
如果我用&#174; => (\u00ae) 替换字符,它会正确显示。
没有将我的元数据转换为 ISO-8859-1,我应该为此使用最佳实践吗?
【问题讨论】:
-
您是否看到了一些缓存结果?不确定如何验证这一点,也许做一个小改动,例如 - 广告时间戳
-
我们使用了 google web-admin 实用程序,您可以在其中生成哈希并将其添加到另一个元数据标签,然后请求重新获取页面。新的 fetch 实用程序显示传入的元数据并在其中包含字符。
-
您应该发布解决方案的答案,而不是将解决方案编辑到问题中。
标签: utf-8 metadata search-engine