【发布时间】:2016-04-18 08:21:15
【问题描述】:
是否有任何字符编码在消费设备(与大型机相反)上相当常见,并且将字母 A-Za-z0-9 映射到不同的 ASCII?
目前我正在考虑一个 Java 应用程序,所以我想知道某个国家/地区的某些 Java 软件的临时用户是否有可能以"AZaz09".getBytes() 返回的方式报告defaultCharset与"AZaz09".getBytes("UTF-8") 不同的东西。我正在尝试确定是否必须解决某些兼容性问题,这些问题可能是由这方面的不同行为引起的。
我知道从历史上看,EBCDIC 将是 ASCII 不兼容编码的主要示例。但它是用于任何最近的消费设备,还是仅用于 IBM 大型机和老式计算机? EBCDIC 的遗产是否存在于某些国家/地区的通用编码中?
我还知道 UTF-16 与 ASCII 不兼容,并且在 Windows 上以这种方式对文件进行编码是很常见的。但据我所知,这始终只是文件内容,而不是默认的应用程序区域设置。用户是否可以将他们的 Windows 机器配置为使用 UTF-16 作为系统代码页而不会破坏至少一半的应用程序?
据我所知,亚洲使用的所有 pre-Unicode 多字节编码仍然将 ASCII 范围 00-7F 映射到至少在字母和数字方面与 ASCII 兼容的东西。是否有任何亚洲编码仍在使用中,它的 all 代码点使用超过一个字节?或者也许在其他大陆?
【问题讨论】:
标签: java encoding character-encoding ascii codepages