b2科目四模拟试题多少题驾考考爆了怎么补救
b2科目四模拟试题多少题 驾考考爆了怎么补救

ASCII,GB2312,GBK,GB18030,Unicode,UTF-8字

电脑杂谈  发布时间:2020-05-19 08:08:38  来源:网络整理

苍穹榜之圣灵集下载_警察锅哥40集迅雷下载_unicode8.0字符集下载

查询ASCII码表:

ASCII字符集编码

ASCII码是7位代码. 字符在计算机中以ASCII码表示. 长度为1个字节,带符号的字符号. 编码范围是0x00-0x7F(0〜127). ASCII字符集包括诸如英文字母,阿拉伯数字和标点符号之类的字符. 其中0x00-0x20和0x7F总共具有33个控制字符.

ASCII十六进制控制字代码的含义

00 00 NUL空

01 01 SOH标题开始

02 02 STX文本开始

03 03 ETX文本结束

04 04EOT传输结果

05 05ENQ查询

06 06ACK确认

07 07BEL铃铛

08 08BS退格

09 09HT水平列表

10 0ALF换行符

110BVT垂直列表

120CFF换页

130DCR回车

140ESO换档(移出)

150FSI移入(Shift-In)

1610DLE数据链接扩展

苍穹榜之圣灵集下载_unicode8.0字符集下载_警察锅哥40集迅雷下载

1711DC1设备控件1

1812DC2设备控制2

1913DC3设备控制3

2014D设备控制4

2115NAK不确认

2216SYN同步字符

2317ETB传输块结构

2418CAN无效

2519EM介质的结尾

261ASUB更换

271BESC扩展名

281CFS文件分隔符

291DGS组分隔符

301ERS记录分隔符

311FUS单位分隔符

ASCII码比较表

ASCII码

键盘

ASCII码

键盘

ASCII码

警察锅哥40集迅雷下载_苍穹榜之圣灵集下载_unicode8.0字符集下载

键盘

ASCII码

键盘

空格

仅支持ASCII码的系统将忽略每个字节的最高位,而仅认为低7位有效. HZ字符编码是一种早期编码,旨在在仅支持7位ASCII的系统中传输中文. 许多早期的邮件系统仅支持ASCII编码. 为了传输中文邮件,必须使用BASE64或其他编码方法.

GB2312字符集编码

规定: 小于127的字符的含义与原始字符的含义相同unicode8.0字符集下载,但是当两个大于127的字符并置时,表示中文字符,并且从前一个字节(他称为高字节)开始使用0xA1 0xF7,下一个字节(低字节)

从0xA1到0xFE,因此我们可以组合7000多个简体中文字符. 在这些编码中,我们甚至还以ASCII形式包括了数学符号,罗马希腊字母和日语假名. 原始数字,标点符号和字母都已用两字节代码重新编码. 通常将其称为“全角”字符,将最初低于127的字符称为“半角”字符. <

中国人对此非常满意,因此他们将这种汉字方案称为“ GB2312”. GB2312是ASCII的中文扩展.

GB2312是中文字符集和编码的代码. 中文名称是“用于信息交换的汉字编码字符集”. 它由中华人民共和国国家标准局发布,并于1981年5月1日实施. GB是汉语拼音的缩写“ GB”.

GB2312字符集(字符集)仅包含简体中文字符以及常用的字母和符号,主要在中国大陆和新加坡. GB2312包含7445个字符,其中包括6763个简体中文字符和682个字母和符号.

GB2312将收集到的字符分为94个区域,从01区到94区. 每个区域包含94个字符,从01到94位数字. GB2312的每个字符均由其唯一的相应区号和位数确定. 例如: 汉字“ ah”,在区域16中的数字为01.

GB2312字符集位置分布表:

区号,字数,字符类别

01 94个通用符号

02 72序列号

03 94拉丁字母

04 83日本假名

05 86片假名

06 48个希腊字母

苍穹榜之圣灵集下载_unicode8.0字符集下载_警察锅哥40集迅雷下载

07 66俄语字母

08 63中文注音符号

09 76图形符号

10-15备用区

16-55 3755一流的汉字,按拼音排列

56-87 3008第二级汉字,按笔画顺序

88-94备用区

本手册列出了GB2312的所有字符及其区号.

GB2312编码

GB2312的原始编码(编码)对于每个包含的字符以两个字节(字节)表示. 第一个字节是“高字节”,它是通过将字符的区域代码值加32形成的;第二个字节是“低字节”,它是通过将字符的位值加32形成的. 例如: 汉字“ ah”,在区域16中的数字为01. 其高字节为16 + 32 = 48(0x30),低字节为01 + 32 = 33(0x21),组合代码为0x3021.

在区域号的值上加上32的原因是为了避免低值字节间隔.

由于GB2312原始编码与ASCII编码字节重叠,所以当前的GB2312编码是通过在原始编码的两个字节上加128形成的. 例如: 汉字“ ah”,在区域16中的数字为01. 其原始代码为0x3021,密码为0xB0A1.

如果没有其他说明,GB2312通常会引用此修改后的代码.

GB2312的编码范围是0xA1A1-0x7E7E. 删除未定义区域后unicode8.0字符集下载,可以理解为实际编码范围为0xA1A1-0xF7FE.

以上句子不正确. 应该说GB2312的每个汉字由两个字节组成,每个字节的范围为0xA1〜0xFE,每个字节有94个编码范围,并且位置编码数量完全对应.

EUC-CN可以理解为GB2312的别名,它与GB2312完全相同.

应将位置代码视为字符集的定义,该字符集定义了包含的字符和字符位置,GB2312和EUC-CN是在实际计算机环境中支持此字符集的编码. HZ和ISO-2022-CN是相应位代码字符集的另两个代码,它们都使用7位代码空间来支持汉字. 位置代码和GB2312编码之间的关系有点像Unicode和UTF-8.

GBK字符集编码

但是汉字太多了,我们很快发现,有很的名字在这里不能打,特别是一些国家对其他人很麻烦. 因此,我们必须继续放置不使用代码点的GB2312来查找并诚实地使用它.

以后还不够,因此不再需要低字节必须是第127个字节之后的内部代码,只要第一个字节大于127,就固定为指示这是第127个字节的开始汉字,无论其后是否跟扩展字符集中的内容. 结果,扩展的编码方案称为“ GBK”标准. GBK包含GB2312的所有内容,同时还增加了将近20,000个新的汉字(包括传统字符)和符号.

GBK编码是GB2312编码的超集,它与GB2312完全兼容. 同时,GBK在Unicode基本多语言平面中包含所有CJK汉字. 与GB2312一样,GBK也支持希腊字母,日语假名字母,俄语字母和其他字符,但不支持韩语的语音字符(非中文字符). GBK还包括GB2312中未包含的诸如部首符号和垂直标点符号之类的字符.

苍穹榜之圣灵集下载_警察锅哥40集迅雷下载_unicode8.0字符集下载

GBK的总编码范围是: 高字节范围是0×81-0xFE,低字节范围是0x40-7E和0x80-0xFE,不包括低字节0×7F的组合.

低字节为0x40-0x7E的GBK字符具有某些特征,因为这些字符占据ASCII码的位置,这会给某些系统带来麻烦.

在某些系统中,0x40-0x7E中的字符(例如“ |”)用作特殊符号. 在定位这些符号时,他们尚未判断这些符号是否属于某个GBK字符的低字节,这将导致错误. 判断. 在支持GB2312的环境中不存在此问题. 应该注意的是,在GBK支持的环境中,小于0x80的字节可能不是ASCII符号;另外,最好使用小于0×40的ASCII符号作为一些特殊符号,以便您可以快速定位,而不必担心它的另一半汉字. Big5编码中也存在相应的问题.

CP936和GBK略有不同. 在大多数情况下,CP936可以用作GBK的别名.

GB18030字符集编码

GB18030编码向后兼容GBK和GB2312. 兼容意味着不仅字符兼容,而且相同字符的编码也相同. GB18030包含Unicode3.1中的所有字符,包括中国少数民族字符,GBK不支持的朝鲜语字符等. 也可以说,世界上大多数民族的特征都包括在内.

GBK和GB2312都是双字节等宽编码. 如果计算与ASCII兼容的单字节,也可以理解为单字节和双字节可变长度编码. GB18030编码是可变长度编码,有单字节,双字节和四字节三种方式.

GB18030的单字节编码范围是0x00-0x7F,完全等同于ASCII;双字节编码范围与GBK相同,高字节为0x81-0xFE,低字节为0x40 -0x7E和0x80 -FE;四字节编码中第一和第三字节的编码范围是0x81-0xFE,第二和第四字节是0x30-0x39.

Windows中的CP936代码页使用0x80表示欧元符号,而GB18030编码不使用0x80编码位,并且欧元符号在其他位置表示. 这可以理解为GB18030向下兼容性中的一个小问题. 还可以理解,0x80是CP936对GBK的扩展,而GB18030仅与GBK兼容.

Unicode字符集编码

每种语言的不同代码页增加了需要支持不同语言的软件的复杂性. 因此人们开发了一种称为unicode的世界标准. Unicode为每个字符提供唯一的特定值,而与平台,软件和语言无关. 换句话说,列出了世界上所有使用的字符,并且每个字符都有唯一的特定值.

Unicode的最初目标是使用16位编码来提供超过65,000个字符的映射. 但这还不够,它不能涵盖所有历史文本,也不能解决传输问题(植入性头痛),尤其是在那些基于网络的应用程序中. 现有软件必须做很多工作才能对16位数据进行编程.

因此,Unicode开发了三组带有一些基本保留字符的编码方法. 它们是UTF-8,UTF-16和UTF-32. 顾名思义,在UTF-8中,字符以8位序列编码,一个或几个字节代表一个字符. 这种方法的最大优点是UTF-8保留了ASCII字符的编码作为其一部分. 例如,在UTF-8和ASCII中,“ A”的编码为0x41.

UTF-16和UTF-32分别是Unicode的16位和32位编码方法. 考虑到最初的目的,Unicode通常被称为UTF-16. 在讨论Unicode时,重要的是要了解使用哪种编码方法.

UTF-8字符集编码

Unicode转换格式8位,允许BOM,但通常不带BOM. 它是一种多字节编码,用于解决国际字符. 它使用8位(1个字节)表示英语,使用24个(3个字节)表示中文. UTF-8包含世界上所有国家/地区所需的字符,是国际编码,并且具有很强的通用性. UTF-8编码的文本可以在支持不同国家/地区的UTF8字符集的浏览器上显示. 例如,如果使用UTF8编码,则外国人可以用英语IE显示中文,而无需下载IE的中文支持包.

GBK文本编码以双字节表示,即中文和英文字符均以双字节表示. 为了区分中文,最高位设置为1. GBK包含所有汉字,是一个国家代码,通用性不如UTF8,但是UTF8占用的比GBD大.

GBK,GB2312等与UTF8之间的转换必须通过Unicode编码:

GBK,GB2312-Unicode-UTF8

UTF8--Unicode-GBK,GB2312

对于网站或论坛,如果英文字符太多,建议使用UTF-8节省空间. 但是,许多论坛中的插件目前仅支持GBK.

下表列出了字符集中的0-127个字符.

代码字符代码字符代码字符代码字符

[空格]


本文来自电脑杂谈,转载请注明本文网址:
http://www.pc-fly.com/a/jisuanjixue/article-215098-1.html

    相关阅读
      发表评论  请自觉遵守互联网相关的政策法规,严禁发布、暴力、反动的言论

      • 张英荣
        张英荣

        它已超出了双边或多边的范畴

      • 王思婕
        王思婕

        韬啊要加油啊

      • 甫尔哈提阿不都沙拉木
        甫尔哈提阿不都沙拉木

        一个让人随便入侵领海领空的国家还谈什么强国

      热点图片
      拼命载入中...