【发布时间】:2012-03-27 04:28:40
【问题描述】:
我阅读了很多链接和建议,毕竟当我需要在 Python 中操作不是 ASCII 字符的字符串时,我更加困惑。
我在 Ubuntu 上使用 Python 2.7:
#!/usr/bin/python
# -*- coding: utf-8 -*-
for i, j in enumerate('Сон'): print '%d: %s' % (i+1, j)
输出:
1: Ð
2: ¡
3: Ð
4: ¾
5: Ð
6: ½
我获得 3 个 UTF-8 编码字符而不是 6 个字节字符的最简单方法是什么?
【问题讨论】:
-
此链接是否回答了您的问题 - stackoverflow.com/questions/8873517/…
-
或者如果它是一个变量而不是文字,
utf8_string.decode('utf-8')。