【问题标题】:How can I interpret below mentioned UTF-8 range我如何解释下面提到的 UTF-8 范围
【发布时间】:2016-11-07 10:19:44
【问题描述】:

我通过了下面的 if-loop

 if (((current >= 0x20) && (current <= 0xD7FF))
                || ((current >= 0xE000) && (current <= 0xFFFD))
                || ((current >= 0x10000) && (current <= 0x10FFFF))) {

            out.append(current);

        }

我正在尝试搜索这些范围代表什么,但我没有得到答案。你能帮我解释一下这些范围吗?

【问题讨论】:

标签: java utf-8 utf


【解决方案1】:

这些是空格上方 unicode 字符的有效范围。 0x20 以下是控制字符(包括换行符和制表符) 0xD800 和 0xDFFF 之间用于编码字符 > 0xFFFF 使用 UTF-16。

注意:如果 current 是 char,则 current &gt;= 0x10000 始终为 false。如果currentint,那么out.append(current); 将打印数字而不是字符。

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 2021-09-16
    • 1970-01-01
    • 1970-01-01
    • 2017-09-09
    • 2012-08-23
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多