【问题标题】:pd.read_csv: utf-8' codec can't decode byte 0x98 in position 61: invalid start bytepd.read_csv:utf-8' 编解码器无法解码位置 61 中的字节 0x98:无效的起始字节
【发布时间】:2020-01-13 21:43:12
【问题描述】:

我想从https://www.osha.gov/fatalities/reports/archive 下载一个 csv 文件。

请试试 2015 财年的那个。

我的代码是这样的:

a=pd.read_csv('C://.../fy15_federal-state_summaries.csv',encoding = "utf-8")

但我仍然收到错误:

UnicodeDecodeError: 'utf-8' codec can't decode byte 0x98 in position 61: invalid start byte

我也尝试了不同的方法。但都不起作用。有人可以帮我吗?

【问题讨论】:

    标签: python csv input unicode utf-8


    【解决方案1】:

    这是encoding问题。

    你需要找出文件的正确编码。

    在这种情况下是1250,所以:

    a=pd.read_csv(r'C:\...\fy15_federal-state_summaries.csv',encoding = "1250")
    

    【讨论】:

    • 那么,我怎样才能找到一个文件使用的编码?谢谢
    • 据我所知,没有可靠的方法来做到这一点。有时可以提供帮助的一种方法是使用指示文件编码的文本编辑器(如 Notepadd++) - 但是,就像在这种情况下一样,它并不总是有帮助。更好的解决方案是常识。
    猜你喜欢
    • 1970-01-01
    • 2018-02-10
    • 2018-06-12
    • 2020-06-22
    • 2021-09-23
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多