汉字编码标准

来源:百度知道 编辑:UC知道 时间:2024/05/06 08:23:57
一般所说的一个汉字占两个字节有前提什么条件吗?现行的汉子编码标准中汉字占多少字节呢?比如GBK、GB2312、unicode等等。
谢谢:)

汉字编码标是汉字设计的一种便于输入计算机的代码的标准。
汉字编码是汉字设计的一种便于输入计算机的代码。
由于电子计算机现有的输入键盘与英文打字机键盘完全兼容。因而如何输入非拉丁字母的文字(包括汉字)便成了多年来人们研究的课题。 汉字信息处理系统一般包括编码、输入、存储、编辑、输出和传输。编码是关键。不解决这个问题,汉字就不能进入计算机。

一般来说它们都占两个字节,区别只是用到的位数
表示字符和符号的多少顺序为:
Unicode>GBK>GB2312
其中Unicode分为UTF-8(一个字节),UTF-16(两个字节)
GBK可以表示简繁汉字
GB2312只能表示简体

  汉字编码方案繁多,需要有一个统一的标准。1981年,国家标准局公布了《信息交换用汉字编码字符集基本集》(简称汉字标准交换码),共分两级,一级3755个字,二级3008个字,共6763个字。这种汉字标准交换码是计算机的内部码,可以为各种输入输出设备的设计提供统一的标准,使各种系统之间的信息交换有共同一致性,从而使信息资源的共享得以保证。正在制定《信息交换用汉字编码字符集辅助集》,以满足少数用字量超过基本集的用户和台湾、香港等地的需要。

一般来说它们都占两个字节,区别只是用到的位数
表示字符和符号的多少顺序为:
Unicode>gbk>GB2312
其中Unicode分为UTF-8(一个字节),UTF-16(两个字节)
gbk可以表示简繁汉字
GB2312只能表示简体

都是两个字节

GBK 2个字节
GB2312 两个字节 GB2312 能够转化为GBK

unicode 三个字节