通常我们所说是2字节(GB-2312)。
具体依据汉字编码形式有所不同:
GB-231280 编码为 2个字节(Byte) 包含了 20902 个汉字,其编码范围是 0x8140-0xfefe。
GB18030-2000(GBK2K) 在 GBK 的基础上进一步扩展了汉字,增加了藏、蒙等少数民族的字形。编码是变长的,其二字节部分与 GBK 兼容;四字节部分是扩充的字形、字位,其编码范围是首字节 0x81-0xfe、二字节0x30-0x39、三字节 0x81-0xfe、四字节0x30-0x39
Unicode 范围一般所用为\U0000-\UFFFF,对于CJK EXT B区汉字,范围大于\U20000
UTF, 按其基本长度所用位数分为UTF-8/16/32。其中:
UTF-8是变长编码,每个Unicode代码点按照不同范围,可以有1-3字节的不同长度。
UTF-16长度相对固定,只要不处理大于\U200000范围的字符,每个Unicode代码点使用16位即2字节表示,超出部分使用两个UTF-16即4字节表示。按照高低位字节顺序,又分为UTF-16BE/UTF-16LE。
UTF-32长度始终固定,每个Unicode代码点使用32位即4字节表示。按照高低位字节顺序,又分为UTF-32BE/UTF-32LE。
本文地址: http://www.goggeous.com/20241228/1/978548
文章来源:天狐定制
版权声明:除非特别标注,否则均为本站原创文章,转载时请以链接形式注明文章出处。
2025-01-08职业培训
2025-01-08职业培训
2025-01-08职业培训
2025-01-08职业培训
2025-01-08职业培训
2025-01-08职业培训
2025-01-08职业培训
2025-01-08职业培训
2025-01-08职业培训
2025-01-08职业培训
2024-12-28 16:06:41职业培训
2024-12-28 16:06:39职业培训
2024-12-28 16:06:38职业培训
2024-12-28 16:06:37职业培训
2024-12-28 16:06:36职业培训
2024-12-28 16:06:35职业培训
2024-12-28 16:06:34职业培训
2024-12-28 16:06:26职业培训
2024-12-28 16:06:25职业培训
2024-12-28 16:06:22职业培训
2024-12-01 05:41职业培训
2024-11-28 19:47职业培训
2025-01-08 01:53职业培训
2024-12-22 12:33职业培训
2024-12-02 04:47职业培训
2024-11-28 12:55职业培训
2025-01-02 09:06职业培训
2025-01-05 18:08职业培训
2024-11-27 21:46职业培训
2024-12-22 18:32职业培训
扫码二维码
获取最新动态