【问题标题】:Does MySQL UTF8 collation fit japanese and korean characters?MySQL UTF8 排序规则是否适合日文和韩文字符?
【发布时间】:2013-09-13 22:31:55
【问题描述】:

我已在 PHP 和 MySQL 中将所有排序规则和字符集设置为 UTF8。没有问题。但正如http://dev.mysql.com/doc/refman/5.5/en/charset-unicode-utf8mb4.html 所见,标准utf8_general_ci 排序规则使用三个字节来存储字符。这应该足以存储所有BMP 字符。但是我仍然没有发现任何提示,如果所有韩文和日文字符都包含在 BMP 中,或者是否有需要存储四个字节的字符。我只是想知道,utf8_general_ciutf8_bin 是否真的足以存储所有韩文/日文字符,或者我是否必须使用 utf8mb4_general_ciutf8mb4_bin

【问题讨论】:

    标签: mysql unicode utf-8 utf8mb4


    【解决方案1】:

    最常用的字符在 BMP 中。高等位面中的字符大多是稀有且具有历史意义的,但其中一些可能会被用于个人名称中。如果您可以使用utf8mb4,您可能应该使用。

    【讨论】:

    • 回到问题... 是的,韩语、片假名和平假名适合 utf8 和 utf8mb4。但是,汉字,如果它是中文的“全部”,则不是。部分中文和表情符号需要utf8mb4;这些都不是“罕见的或历史悠久的”。
    猜你喜欢
    • 2011-10-01
    • 2015-05-29
    • 2015-07-13
    • 1970-01-01
    • 2012-10-26
    • 1970-01-01
    • 2016-11-08
    • 2012-12-29
    • 2023-03-17
    相关资源
    最近更新 更多