
查询ASCII码表:
ASCII字符集编码
ASCII码是7位代码. 字符在计算机中以ASCII码表示. 长度为1个字节,带符号的字符号. 编码范围是0x00-0x7F(0〜127). ASCII字符集包括诸如英文字母,阿拉伯数字和标点符号之类的字符. 其中0x00-0x20和0x7F总共具有33个控制字符.
ASCII十六进制控制字代码的含义
00 00 NUL空
01 01 SOH标题开始
02 02 STX文本开始
03 03 ETX文本结束
04 04EOT传输结果
05 05ENQ查询
06 06ACK确认
07 07BEL铃铛
08 08BS退格
09 09HT水平列表
10 0ALF换行符
110BVT垂直列表
120CFF换页
130DCR回车
140ESO换档(移出)
150FSI移入(Shift-In)
1610DLE数据链接扩展

1711DC1设备控件1
1812DC2设备控制2
1913DC3设备控制3
2014D设备控制4
2115NAK不确认
2216SYN同步字符
2317ETB传输块结构
2418CAN无效
2519EM介质的结尾
261ASUB更换
271BESC扩展名
281CFS文件分隔符
291DGS组分隔符
301ERS记录分隔符
311FUS单位分隔符
ASCII码比较表
ASCII码
键盘
ASCII码
键盘
ASCII码

键盘
ASCII码
键盘
空格
&
仅支持ASCII码的系统将忽略每个字节的最高位,而仅认为低7位有效. HZ字符编码是一种早期编码,旨在在仅支持7位ASCII的系统中传输中文. 许多早期的邮件系统仅支持ASCII编码. 为了传输中文邮件,必须使用BASE64或其他编码方法.
GB2312字符集编码
规定: 小于127的字符的含义与原始字符的含义相同unicode8.0字符集下载,但是当两个大于127的字符并置时,表示中文字符,并且从前一个字节(他称为高字节)开始使用0xA1 0xF7,下一个字节(低字节)
从0xA1到0xFE,因此我们可以组合7000多个简体中文字符. 在这些编码中,我们甚至还以ASCII形式包括了数学符号,罗马希腊字母和日语假名. 原始数字,标点符号和字母都已用两字节代码重新编码. 通常将其称为“全角”字符,将最初低于127的字符称为“半角”字符. <
中国人对此非常满意,因此他们将这种汉字方案称为“ GB2312”. GB2312是ASCII的中文扩展.
GB2312是中文字符集和编码的代码. 中文名称是“用于信息交换的汉字编码字符集”. 它由中华人民共和国国家标准局发布,并于1981年5月1日实施. GB是汉语拼音的缩写“ GB”.
GB2312字符集(字符集)仅包含简体中文字符以及常用的字母和符号,主要在中国大陆和新加坡. GB2312包含7445个字符,其中包括6763个简体中文字符和682个字母和符号.
GB2312将收集到的字符分为94个区域,从01区到94区. 每个区域包含94个字符,从01到94位数字. GB2312的每个字符均由其唯一的相应区号和位数确定. 例如: 汉字“ ah”,在区域16中的数字为01.
GB2312字符集位置分布表:
区号,字数,字符类别
01 94个通用符号
02 72序列号
03 94拉丁字母
04 83日本假名
05 86片假名
06 48个希腊字母

07 66俄语字母
08 63中文注音符号
09 76图形符号
10-15备用区
16-55 3755一流的汉字,按拼音排列
56-87 3008第二级汉字,按笔画顺序
88-94备用区
本手册列出了GB2312的所有字符及其区号.
GB2312编码
GB2312的原始编码(编码)对于每个包含的字符以两个字节(字节)表示. 第一个字节是“高字节”,它是通过将字符的区域代码值加32形成的;第二个字节是“低字节”,它是通过将字符的位值加32形成的. 例如: 汉字“ ah”,在区域16中的数字为01. 其高字节为16 + 32 = 48(0x30),低字节为01 + 32 = 33(0x21),组合代码为0x3021.
在区域号的值上加上32的原因是为了避免低值字节间隔.
由于GB2312原始编码与ASCII编码字节重叠,所以当前的GB2312编码是通过在原始编码的两个字节上加128形成的. 例如: 汉字“ ah”,在区域16中的数字为01. 其原始代码为0x3021,密码为0xB0A1.
如果没有其他说明,GB2312通常会引用此修改后的代码.
GB2312的编码范围是0xA1A1-0x7E7E. 删除未定义区域后unicode8.0字符集下载,可以理解为实际编码范围为0xA1A1-0xF7FE.
以上句子不正确. 应该说GB2312的每个汉字由两个字节组成,每个字节的范围为0xA1〜0xFE,每个字节有94个编码范围,并且位置编码数量完全对应.
EUC-CN可以理解为GB2312的别名,它与GB2312完全相同.
应将位置代码视为字符集的定义,该字符集定义了包含的字符和字符位置,GB2312和EUC-CN是在实际计算机环境中支持此字符集的编码. HZ和ISO-2022-CN是相应位代码字符集的另两个代码,它们都使用7位代码空间来支持汉字. 位置代码和GB2312编码之间的关系有点像Unicode和UTF-8.
GBK字符集编码
但是汉字太多了,我们很快发现,有很的名字在这里不能打,特别是一些国家对其他人很麻烦. 因此,我们必须继续放置不使用代码点的GB2312来查找并诚实地使用它.
以后还不够,因此不再需要低字节必须是第127个字节之后的内部代码,只要第一个字节大于127,就固定为指示这是第127个字节的开始汉字,无论其后是否跟扩展字符集中的内容. 结果,扩展的编码方案称为“ GBK”标准. GBK包含GB2312的所有内容,同时还增加了将近20,000个新的汉字(包括传统字符)和符号.
GBK编码是GB2312编码的超集,它与GB2312完全兼容. 同时,GBK在Unicode基本多语言平面中包含所有CJK汉字. 与GB2312一样,GBK也支持希腊字母,日语假名字母,俄语字母和其他字符,但不支持韩语的语音字符(非中文字符). GBK还包括GB2312中未包含的诸如部首符号和垂直标点符号之类的字符.

GBK的总编码范围是: 高字节范围是0×81-0xFE,低字节范围是0x40-7E和0x80-0xFE,不包括低字节0×7F的组合.
低字节为0x40-0x7E的GBK字符具有某些特征,因为这些字符占据ASCII码的位置,这会给某些系统带来麻烦.
在某些系统中,0x40-0x7E中的字符(例如“ |”)用作特殊符号. 在定位这些符号时,他们尚未判断这些符号是否属于某个GBK字符的低字节,这将导致错误. 判断. 在支持GB2312的环境中不存在此问题. 应该注意的是,在GBK支持的环境中,小于0x80的字节可能不是ASCII符号;另外,最好使用小于0×40的ASCII符号作为一些特殊符号,以便您可以快速定位,而不必担心它的另一半汉字. Big5编码中也存在相应的问题.
CP936和GBK略有不同. 在大多数情况下,CP936可以用作GBK的别名.
GB18030字符集编码
GB18030编码向后兼容GBK和GB2312. 兼容意味着不仅字符兼容,而且相同字符的编码也相同. GB18030包含Unicode3.1中的所有字符,包括中国少数民族字符,GBK不支持的朝鲜语字符等. 也可以说,世界上大多数民族的特征都包括在内.
GBK和GB2312都是双字节等宽编码. 如果计算与ASCII兼容的单字节,也可以理解为单字节和双字节可变长度编码. GB18030编码是可变长度编码,有单字节,双字节和四字节三种方式.
GB18030的单字节编码范围是0x00-0x7F,完全等同于ASCII;双字节编码范围与GBK相同,高字节为0x81-0xFE,低字节为0x40 -0x7E和0x80 -FE;四字节编码中第一和第三字节的编码范围是0x81-0xFE,第二和第四字节是0x30-0x39.
Windows中的CP936代码页使用0x80表示欧元符号,而GB18030编码不使用0x80编码位,并且欧元符号在其他位置表示. 这可以理解为GB18030向下兼容性中的一个小问题. 还可以理解,0x80是CP936对GBK的扩展,而GB18030仅与GBK兼容.
Unicode字符集编码
每种语言的不同代码页增加了需要支持不同语言的软件的复杂性. 因此人们开发了一种称为unicode的世界标准. Unicode为每个字符提供唯一的特定值,而与平台,软件和语言无关. 换句话说,列出了世界上所有使用的字符,并且每个字符都有唯一的特定值.
Unicode的最初目标是使用16位编码来提供超过65,000个字符的映射. 但这还不够,它不能涵盖所有历史文本,也不能解决传输问题(植入性头痛),尤其是在那些基于网络的应用程序中. 现有软件必须做很多工作才能对16位数据进行编程.
因此,Unicode开发了三组带有一些基本保留字符的编码方法. 它们是UTF-8,UTF-16和UTF-32. 顾名思义,在UTF-8中,字符以8位序列编码,一个或几个字节代表一个字符. 这种方法的最大优点是UTF-8保留了ASCII字符的编码作为其一部分. 例如,在UTF-8和ASCII中,“ A”的编码为0x41.
UTF-16和UTF-32分别是Unicode的16位和32位编码方法. 考虑到最初的目的,Unicode通常被称为UTF-16. 在讨论Unicode时,重要的是要了解使用哪种编码方法.
UTF-8字符集编码
Unicode转换格式8位,允许BOM,但通常不带BOM. 它是一种多字节编码,用于解决国际字符. 它使用8位(1个字节)表示英语,使用24个(3个字节)表示中文. UTF-8包含世界上所有国家/地区所需的字符,是国际编码,并且具有很强的通用性. UTF-8编码的文本可以在支持不同国家/地区的UTF8字符集的浏览器上显示. 例如,如果使用UTF8编码,则外国人可以用英语IE显示中文,而无需下载IE的中文支持包.
GBK文本编码以双字节表示,即中文和英文字符均以双字节表示. 为了区分中文,最高位设置为1. GBK包含所有汉字,是一个国家代码,通用性不如UTF8,但是UTF8占用的比GBD大.
GBK,GB2312等与UTF8之间的转换必须通过Unicode编码:
GBK,GB2312-Unicode-UTF8
UTF8--Unicode-GBK,GB2312
对于网站或论坛,如果英文字符太多,建议使用UTF-8节省空间. 但是,许多论坛中的插件目前仅支持GBK.
下表列出了字符集中的0-127个字符.
代码字符代码字符代码字符代码字符
[空格]
&
本文来自电脑杂谈,转载请注明本文网址:
http://www.pc-fly.com/a/jisuanjixue/article-215098-1.html
韬啊要加油啊
一个让人随便入侵领海领空的国家还谈什么强国
它已超出了双边或多边的范畴