【发布时间】:2023-02-07 20:37:59
【问题描述】:
我正在尝试使用带有 python 3 的“xmltodict”库读取 XML.dump 文件,以从该文件制作字典。 我使用的代码是这样的:
import xmltodict
with open('file1.xml.dump') as fd:
content = fd.read()
doc = xmltodict.parse(content)
我得到的错误是:
UnicodeDecodeError: 'utf-8' codec can't decode byte 0x80 in position 0: invalid start byte
有谁知道这个错误是关于这个错误的是什么以及如何解决这个问题?
我还在with open语句中添加了encoding='UTF-8',我得到了同样的错误。
【问题讨论】:
-
打开文件时请给出utf编码\
-
@HimanshuPoddar
open默认使用UTF-8,这就是导致错误的原因。该文件不是 UTF-8 -
我不是在谈论 utf-8 编码
-
@Sarah 询问创建该文件的人。
-
我们不知道那个文件使用了什么编码,也不知道为什么它不是 UTF8,事实上的标准,尤其对于 XML 文件。你确定它甚至是 XML 吗? XML 文档以
<开头。该文件根本不是 XML,或者在 XML 部分之前包含额外的文本