【发布时间】:2011-01-15 00:39:59
【问题描述】:
所以,我正在做一个纯 C (ANSI 9899:1999) 项目,并试图找出从哪里开始:Unicode、UTF-8 和所有爵士乐。
具体来说,它是一个语言解释器项目,我需要在两个主要地方处理 Unicode:读取源文件(该语言表面上支持 Unicode 标识符等),以及“字符串”对象。
我熟悉有关 Unicode、UTF-7/8/16/32 和 UCS-2/4 等等的所有显而易见的基础知识……我主要在寻找有用的、特定于 C 的(即是,请不要使用 C++ 或 C#,这是之前在 SO 上记录的所有内容)资源,关于我在 C 中实现 Unicode 友好的东西的“下一步”。
非常欢迎任何链接、手册页、维基百科文章、示例代码。我还将尝试在原始问题中保留此类资源的列表,以供以后遇到它的任何人使用。
- 如果你不熟悉 Unicode,在考虑其他任何事情之前必须阅读,实际上是什么编码:http://www.joelonsoftware.com/articles/Unicode.html
- UTF-8 主页:http://www.utf-8.com/
-
man 3 iconv(以及iconv_open和iconvctl) - International Components for Unicode(来自Geoff Reedy)
-
libbasekit,其中似乎包含轻型 Unicode 处理工具 - Glib 有一些 Unicode 函数
- 一个基本的UTF-8 detector函数,作者Christoph
【问题讨论】:
-
+1 为 iconv,只要它可用。在 windows icu 上可能是更好的选择
标签: c string unicode encoding unicode-string