【发布时间】:2011-05-29 04:08:33
【问题描述】:
我正在使用 web2py 的 markdown 模块来处理标记的文本。问题是,人们提交的东西带有智能引号、特殊字符等,我需要用它们的等价物替换它们。
我有这样的文字:'\n\r\n上校的脸色有些苍白。 \xe2\x80\x9c但是,那么 \xe2\x80" 恕我冒昧,先生 \xe2\x80" 我们现在要去 Uvar'
如何确保像在 markdown 内部的文本上那样调用 unicode(txt, 'utf-8') 不会引发错误?文字处理程序插入的花哨的特殊引号是正常原因,但似乎有很多字符是一个问题。
【问题讨论】:
标签: python unicode utf-8 markdown