【发布时间】:2016-03-29 06:06:52
【问题描述】:
我有一个使用 UTF-8 编码的 XML 文件,在 XML 声明中正确指定。
<?xml version="1.0" encoding="UTF-8"?>
该文件包含一些标准 ASCII 之外的字符。特别是它包括带有变音符号的 o。它已正确地将其表示为 2 字节 UTF-8 序列 C0 B6。但在 IE 或 Firefix 中打开时,它显示为除号“÷”,即使我已将默认字体设置为 Arial Unicode。浏览器正确检测(明确指定的)编码为 UTF-8。
显示如下:
<diag_description>Waldenstr÷m macroglobulinemia</diag_description>
我可以上传文件,但它相当大(190k),我不相信复制和粘贴不会在幕后进行转换。
【问题讨论】:
-
你也可以从源头发布那行吗?
-
使用 Notepad++ 抓取:
Waldenstr÷m 巨球蛋白血症 -
使用记事本抓取:
Waldenstr÷m 巨球蛋白血症 -
使用十六进制编辑器获取:
Waldenstr÷m 巨球蛋白血症 关键字节是 C3 B7(这不是我想的那样) -
请记住,应该遵循
<?xml?>声明的编码部分,但文件本身不一定要遵守。听起来这不是这里的问题。
标签: xml unicode encoding utf-8 fonts