【发布时间】:2019-07-15 13:39:19
【问题描述】:
我正在通过 pandas.read_csv() 读取 CSV 文件。当指定 enconding = UTF-8 或 16 时,会报错。
'utf-8' 编解码器无法解码位置 127 中的字节 0xa3:无效起始字节
我的疑问是,当 UTF 是多字节编码而 latin1 是单字节编码时,为什么我在使用 UTF-8 或 16 时会出现错误,但在 latin1 上可以正常工作? UTF不应该更优越,解码所有字符吗?
提前致谢。
尝试编码 = latin1, 'cp1252', 'iso-8859-15'
【问题讨论】:
-
并非每个随机字节组合在 UTF-* 中都有效,但任何随机字节在 Latin-1 中都有效。
标签: python pandas encoding utf-8