【发布时间】:2018-09-29 12:14:59
【问题描述】:
我正在尝试解析包含文本下方文本的 csv (test.csv)
"legalgroup_text" "Aktiebolag" "Aktiebolag" "LGAKTIEBOLAG"
"legalgroup_text" "Allmän försäkringskassa" "Allmän försäkringskassa" "LGALLMAENFOERSAEKRINGSKASSA"
我正在使用编码iso-8859-1,因为该文件包含瑞典字符
import codecs
import csv
with codecs.open('test.csv', encoding='iso-8859-1') as label_file:
data = csv.reader(label_file, delimiter='\t')
for row in data:
print(row)
我遇到了错误
Traceback (most recent call last):
File "/mnt/ashraful/PycharmProjects/Test/test.py", line 6, in <module>
for row in data:
UnicodeEncodeError: 'ascii' codec can't encode characters in position 23-24: ordinal not in range(128)
我也尝试过编码utf-8,但出现错误
UnicodeEncodeError: 'ascii' codec can't encode character u'\xe4' in position 25: ordinal not in range(128)
【问题讨论】:
-
第二行,特别是
ä字符 -
这一行
for row in data: -
如果可以的话,你真的应该迁移到 Python 3。
标签: python python-2.7 python-unicode