【发布时间】:2012-07-18 16:45:31
【问题描述】:
我有一个包含字节序列 c3 82 c2 bf 的文本数据源。在上下文中,我认为它应该是大写的希腊 Phi 符号 (Φ)。
无论如何,我无法弄清楚正在使用什么编码;我正在编写一个 Python 脚本来将这些数据处理到一个需要 Unicode 的数据库中,它会在这个特定的数据序列上引发异常。
对如何处理有什么建议吗?
【问题讨论】:
-
你能发布更多用魔法编码编码的样本数据吗?是什么让你认为它是一个字母?
-
在上下文中它是“磁通量 \xc3\x82\xc2\xbffa”,它可能应该是 Φfa
-
这是目前为止唯一的失败数据,所以我只能继续。