【问题标题】:find unicode range through python script通过python脚本查找unicode范围
【发布时间】:2013-08-26 07:20:10
【问题描述】:

有没有办法找到 unicode 范围,以便我可以用不同的 html 标签标记 unicode。因为我混合了需要打印的 unicode。所以需要为不同的unicode使用不同的标签,以便在模板中对这些标签应用不同的CSS字体。

我正在使用 python、flask、jinjatemplate。只需要一种方法来从 python 脚本中找到范围。

例如http://symbolcodes.tlt.psu.edu/bylanguage/devanagarichart.html unicode 从 अ 开始,根据此链接,

【问题讨论】:

    标签: python css unicode flask jinja2


    【解决方案1】:

    也许您可以使用ord() 函数。它返回字符数值,您可以决定如何处理字符。

    例子:

    devanagari_letter_a = unichr(2309)
    devanagari_letter_aa = unichr(2310)
    
    print devanagari_letter_a.encode('utf-8'), 'value:', ord(devanagari_letter_a)
    print devanagari_letter_aa.encode('utf-8'), 'value:', ord(devanagari_letter_aa)
    

    输出:

    अ value: 2309
    आ value: 2310
    

    【讨论】:

    • 谢谢@simon,我需要一大堆 Devnagari 词汇来测试,所以我想我可以检查一下我在ftp.unicode.org/Public/UNIDATA/UnicodeData.txt找到的 unicode 数据库
    • 是的,完全正确。但要注意数字的基数。 ord() 返回以 10 为基数的数字,但在 unicode 数据库中,数字以十六进制格式存储。 0905 = 十六进制 (2309) 和 2309 = int('0905', 16)
    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2012-04-23
    • 1970-01-01
    • 2023-03-24
    • 2011-02-13
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多