【发布时间】:2020-03-07 10:00:37
【问题描述】:
我已经从 Kaggle 导出了一个 CSV - https://www.kaggle.com/ngyptr/python-nltk-sentiment-analysis。但是,当我尝试遍历文件时,我收到有关某些无法编码的字符的 unicode 错误。
File "C:\Program Files\Python35\lib\encodings\cp850.py", line 19, in encode
return codecs.charmap_encode(input,self.errors,encoding_map)[0]
UnicodeEncodeError: 'charmap' 编解码器无法对位置 264 中的字符 '\u2026' 进行编码:字符映射到
我在打开文件时启用了 utf-8 编码,我认为它会解码 ASCII 字符。显然不是。
我的代码:
with open("sentimentDataSet.csv", "r", encoding="utf-8" ,errors='ignore', newline='') as file:
reader = csv.reader(file)-
for row in reader:
if row:
print(row)
if row[sentimentCsvColumn] == sentimentScores(row[textCsvColumn]):
accuracyCount += 1
print(accuracyCount)
【问题讨论】:
标签: python python-3.x csv