【问题标题】:Why is an XML file with UTF-8 encoding not displaying extended characters correctly为什么使用 UTF-8 编码的 XML 文件不能正确显示扩展字符
【发布时间】:2016-03-29 06:06:52
【问题描述】:

我有一个使用 UTF-8 编码的 XML 文件,在 XML 声明中正确指定。

<?xml version="1.0" encoding="UTF-8"?>

该文件包含一些标准 ASCII 之外的字符。特别是它包括带有变音符号的 o。它已正确地将其表示为 2 字节 UTF-8 序列 C0 B6。但在 IE 或 Firefix 中打开时,它显示为除号“÷”,即使我已将默认字体设置为 Arial Unicode。浏览器正确检测(明确指定的)编码为 UTF-8。

显示如下:

<diag_description>Waldenstr÷m macroglobulinemia</diag_description> 

我可以上传文件,但它相当大(190k),我不相信复制和粘贴不会在幕后进行转换。

【问题讨论】:

  • 你也可以从源头发布那行吗?
  • 使用 Notepad++ 抓取:Waldenstr÷m 巨球蛋白血症
  • 使用记事本抓取:Waldenstr÷m 巨球蛋白血症
  • 使用十六进制编辑器获取:Waldenstr÷m 巨球蛋白血症 关键字节是 C3 B7(这不是我想的那样)
  • 请记住,应该遵循 &lt;?xml?&gt; 声明的编码部分,但文件本身不一定要遵守。听起来这不是这里的问题。

标签: xml unicode encoding utf-8 fonts


【解决方案1】:

据我所知,ö 实际上是 C3 B6(UTF-8 编码),而 ÷ 是 C3 B7。所以我的猜测是你只是在那里有错误的字符。

【讨论】:

  • 谢谢。这很奇怪,但也许以 UTF-8 呈现的代码在某处有一个错误
  • 不知道,但你的十六进制值和你期望的字符肯定有问题。
猜你喜欢
  • 1970-01-01
  • 2012-05-04
  • 2018-09-01
  • 1970-01-01
  • 2015-11-08
  • 1970-01-01
  • 2012-08-09
  • 1970-01-01
相关资源
最近更新 更多