【发布时间】:2020-06-22 21:47:08
【问题描述】:
我尝试用 ascii 字符替换非 ascii 字符。
效果很好:
#!/usr/bin/env python
# -*- coding: utf-8 -*-
from unidecode import unidecode
in_text = u"protégé"
out = unidecode(in_text)
print out
结果:protA(c)gA(c)
在这种情况下,我必须手动复制文本。
问题出在文本前面的'u'。
我想自动阅读。像这样的:
#!/usr/bin/env python
# -*- coding: utf-8 -*-
from unidecode import unidecode
with open("C:\Users\B\Desktop\\0.txt", "r") as f:
in_text = f.read()
char_text = u(in_text)
out = unidecode(char_text)
【问题讨论】:
标签: python non-ascii-characters