【发布时间】:2017-09-21 08:41:34
【问题描述】:
我正在尝试使用 python ftfy 库读取具有混合编码类型的文本。当文本不混合时,这个库会给出很好的结果,即
>>> print(ftfy.fix_text('ünicode'))
ünicode
但是如果文本是混合的,那么就会得到这样的结果,即
>>> print(ftfy.fix_text('Hi to ℙℽ☂ℌϕℿ ünicode'))
ℙℽ☂ℌϕℿ ünicode
这是这个库无法处理的事情吗?有没有办法读取混合编码类型的文本?我还阅读了一些关于 python 和 unicode 的信息,但没有找到如何处理文本具有不同编码类型的好例子。
【问题讨论】:
-
谢谢你让我知道这个图书馆,顺便说一句!
-
是的,看起来很有用的库...
标签: python-3.x unicode encoding utf-8