【发布时间】:2012-02-24 13:46:47
【问题描述】:
我想知道如何检查文件字节顺序标记以确定它是否是 C++ 中的 UTF-8?
【问题讨论】:
-
有什么问题?您需要做的就是将其与 0xEF、0xBB、0xBF 进行比较。我认为您需要详细说明您的问题。
-
使用任何语言的方式都一样。你得到前三个字节。如果它们看起来像 Unicode 字节顺序标记的 UTF-8 字节,那么它就是 UTF-8。如果他们不这样做,那就不是。您是在找人为您编写源代码吗?
-
Nicol——“如果他们不这样做,那就不是”——不是真的。如果它们看起来不像 BOM,那么它很容易仍然是 UTF-8。不需要使用 UTF-8 编码的字节顺序标记。
-
@Nicol 建议您删除或编辑该评论,因为它是错误的。看起来像 Unicode BOM 的字节序列只会告诉您它可能是 Unicode 数据。它可能意味着“”。
标签: c++ utf-8 byte-order-mark