【发布时间】:2021-12-05 09:47:03
【问题描述】:
在使用'from'命令在python中导入一些包时, 例如:从 sklearn.model_selection 导入 train_test_split 从 nltk.tokenize 导入 word_tokenize 我面临一个错误:“utf-8”编解码器无法解码位置 3057 中的字节 0x9c:无效的起始字节。 任何人都可以请我理解我错在哪里..!
【问题讨论】:
标签: utf-8 encode python-3.8
在使用'from'命令在python中导入一些包时, 例如:从 sklearn.model_selection 导入 train_test_split 从 nltk.tokenize 导入 word_tokenize 我面临一个错误:“utf-8”编解码器无法解码位置 3057 中的字节 0x9c:无效的起始字节。 任何人都可以请我理解我错在哪里..!
【问题讨论】:
标签: utf-8 encode python-3.8
请添加其他详细信息,例如日志或屏幕截图
这可能是由解码问题引起的。 尝试添加:
# -*- coding:utf-8 -*-
到代码的顶部。 也许您对 Python 文件的默认解码是 ANSI 或其他。
【讨论】:
coding 注释声明了 仅源文件 的编码,无论如何,UTF-8 是 Python 3 的默认值。它不会影响其他编码/解码操作。