GB2312和utf-8的区别

Posted 红树叶

tags:

篇首语:本文由小常识网(cha138.com)小编为大家整理,主要介绍了GB2312和utf-8的区别相关的知识,希望对你有一定的参考价值。

GB2312编码大约包含6000多汉字(不包括特殊字符),编码范围为第一位b0-f7,第二位编码范围为a1-fe(第一位为cf时,第二位为a1-d3),计算一下汉字个数为6762个汉字。当然还有其他的字符。包括控制键和其他字符大约7573个字符编码
gbk编码是对gb2312编码的扩充,容纳的汉字更多,但仅仅是扩充,没有质的变化。保留了所有gb2312编码,在此基础上进行编码范围的扩充.容纳(包含特殊字符)共22014个字符编码.
gb18030编码是在gbk编码基础上的扩充,因为汉字更多,仅仅使用两位编码已经不能容纳要求的汉字,所以采用了2/4位混和的办法,可以支持更多的汉字编码。并且保留了原有的gbk 2字节编码兼容gb2312和gbk编码的文件。大概容纳55657个编码(包含特殊字符)unicode编码(也就是UTF编码):俗称万国码,致力于使用统一的编码准则表达各国的文字。
为表达更多的文字,utf-8采用2/3混编的方式。目前容纳的汉字范围小于gbk编码。并且以3字节的方式处理中文,带来了兼容性的问题,原有的gbk,gb2312,gb18030编码文件都不能正常的处理,还有很长的路要走。

以上是关于GB2312和utf-8的区别的主要内容,如果未能解决你的问题,请参考以下文章

网络编码 GB2312GBK与UTF-8的区别

URL编码 utf-8 gb2312的区别

charset=gbk和charset=gb2312有啥区别

ANSI和GB2312的区别zz

unicode utf-8 utf-16ascii gbk gb2312 的区别

编码方式的比较,以及UTF-8,gb2312的选择