【发布时间】:2018-05-13 11:52:33
【问题描述】:
我有一个来自 Facebook 的“下载您的数据”功能的 JSON 文件,它没有将 Unicode 字符转义为代码点编号,而是转义为 UTF-8 字节序列。
例如,字母 á (U+00E1) 在 JSON 文件中转义为 \u00c3\u00a1 而不是 \u00e1。 0xC3 0xA1 是 U+00E1 的 UTF-8 编码。
Python 3 中的 json 库将其解码为 á,对应于 U+00C3 和 U+00A1。
有没有办法在 Python 中正确解析这样的文件(以便我得到字母 á)?
【问题讨论】: