【问题标题】:Unicode characters necessary for Japanese, Korean, and Chinese日文、韩文和中文所需的 Unicode 字符
【发布时间】:2016-01-28 11:12:51
【问题描述】:

我试图在没有获得语言学和早期人类历史学位的情况下回答这些基本问题,这似乎是每个 google 搜索的主要方向。

  1. 字体中必须包含哪些 unicode 字符才能按顺序排列 支持日文语言文本的渲染?

  2. 字体中必须包含哪些 unicode 字符才能按顺序排列 支持中文语言文本的渲染?

  3. 字体中必须包含哪些 unicode 字符才能按顺序排列 支持韩文语言文本的呈现?

【问题讨论】:

  • UTF-16 将支持这些语言。
  • 许多方面,例如需要更好的纸张质量、字体大小,以及并非所有字体似乎都具有相同的质量。最好联系当地机构。

标签: unicode fonts multilingual cjk


【解决方案1】:

Code Charts@unicode.org中的东亚文字开始。

例如,平假名是 U+3040 到 U+309F,片假名是 U+30A0 到 U+30FF。

【讨论】:

  • 我建议查看为每个请求集设计的(Unicode 之前的)代码页。 Microsoft 的代码页 932(Shift-JIS/日文)、936(GB2312/简体中文)、949(EUC-KR/韩文)和 950(Big5/繁体中文)将在字符级支持方面让您走得更远。在unicode.org/Public/MAPPINGS/VENDORS/MICSFT/WINDOWS 有从这些代码页到 Unicode 的映射但是:提问者应该进一步追求“支持”的想法:仅仅在字体中存在字符通常是不够的。
【解决方案2】:

您可以通过查看适当的Unicode properties(特别是每个字符的“脚本”)来近似此类列表,但这并不能完全反映实际的字符使用情况。

this tech note 中描述的那些已经为这些语言的字体定义的字符集(例如Adobe-Japan-1-6Adobe-GB-1-5Adobe-Korea1-2)更好的指示符(确切的字符集是defined separately )。 CMap 文件应该允许您将它们转换回 Unicode 代码点。

【讨论】:

    【解决方案3】:

    这取决于您希望为每种语言提供的多少覆盖率。所有这些语言中最常用的字符只需要几千个字符,但偶尔你会遇到一些超出范围的字符。随着系统支持的字符数量的增加,您遇到这些缺失字符的可能性会降低,直到覆盖所有 CJK 字符为止。

    现代字体开发人员使用的一种常用方法是使用 Unicode 之前的字符集中给出的范围,如Big5(-HKSCS)、GB2312 或 18030 等其他人的回答评论中提到的,但是遇到不支持的字符是很常见的。

    在 Unicode 中,创建并定义了一个名为 IICore 的东西,大约一万个字符对于支持这些语言来说是最基本的,在 Unicode 数据库中还有关于它们是否对中文、日文、韩文或韩文至关重要的信息。这样,但是现在几乎没有人使用它们。

    Google 和 Adob​​e 现在正在制作 Noto CJK 或称为 Source Han 字体,它应该涵盖与示例一样多的 CJK 字符。但是,由于文件格式的限制,他们只能在字体中放入大约 65535 个字形,因此在制作过程中必须添加/删除字符。

    最后,特别是对于韩语,在很多情况下,仅支持 Hangul/Jamo 可能就足够了,因为 Hanja(表意字符)除了在专业领域之外已经基本不使用了。请注意,人名和标题中的某些单词可能是仍会使用汉字的这些方面的一部分,因此这取决于它们对您是否重要

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 2016-11-08
      • 2018-06-12
      • 2012-01-07
      • 1970-01-01
      • 2020-05-06
      • 2013-09-13
      • 1970-01-01
      相关资源
      最近更新 更多