【发布时间】:2018-10-31 17:50:51
【问题描述】:
我有一些来自我无法控制的大型 JSON 文件,我正在尝试在 Notepad++ 中清理它们,然后再将它们用作程序输入。
该文件包含许多 unicode 序列,遗憾的是我对此知之甚少。它是使用两个或三个序列来表示一个字符的类型,例如 \u00c3\u00a9 表示 é,而 \u00e2\u0080\u0094 表示一个破折号 (—)。
我花了一整夜在谷歌上搜索如何将这些转换回普通字符,但不幸的是我不太了解我遇到的很多内容。
我最终发现,通过安装 HTML Tag 插件,我可以在它们上使用“Decode JS”,然后将整个文件转换为 ANSI,然后将其表示为 UTF-8,这解决了 的问题大多数角色。
但有些,如破折号或 Ç (\u00c3\u0087),仍然拒绝转换。
谁能指出为什么这些特定字符仍然显示不正确,以及我该如何解决?谢谢。
【问题讨论】:
标签: json unicode notepad++ ansi utf