【发布时间】:2020-03-26 11:56:04
【问题描述】:
我正在尝试解码字符串列表中的字符串,例如 'caf\\xc3\\xab' 如果这是 'café',我想要什么。
我尝试了一些方法,但遇到了问题。
当我这样做时:
for i in range(len(words):
words[i] = words[i].decode("utf8")
我仍然需要转换为字节类型,但是我该怎么做呢,
当我这样做时,我需要删除双反斜杠才能使其工作
b'caf\\xc3\\xab'.decode("utf8")
【问题讨论】:
-
python2的str是字节,你可以使用unicode或者ues python3(在python3中str是unicode)
-
我使用 python3 但从特定格式的文件中读取字符串
-
words.decode()不是就地操作,需要捕获返回值:word = word.decode("utf8")。 (进一步说明:这只会改变循环变量word的值,不会改变words中的元素。)
标签: python python-3.x utf-8