浏览量:184次
什么是编码格式
编码应该就是网页的一种显示形式,和电脑的字库有关系,默认的一般都是gb2132。简单来说如果你电脑上有这种编码,网页会正常显示,如果没有就会出现乱码。
常见的编码格式
ASCII 码
学过计算机的人都知道 ASCII 码,总共有 128 个,用一个字节的低 7 位表示,0~31 是控制字符如换行回车删除等;32~126 是打印字符,可以通过键盘输入并且能够显示出来。
GB2312
它的全称是《信息交换用汉字编码字符集 基本集》,它是双字节编码,总的编码范围是 A1-F7,其中从 A1-A9 是符号区,总共包含 682 个符号,从 B0-F7 是汉字区,包含 6763 个汉字。
GBK
全称叫《汉字内码扩展规范》,是国家技术监督局为 windows95 所制定的新的汉字内码规范,它的出现是为了扩展 GB2312,加入更多的汉字,它的编码范围是 8140~FEFE(去掉 XX7F)总共有 23940 个码位,它能表示 21003 个汉字,它的编码是和 GB2312 兼容的,也就是说用 GB2312 编码的汉字可以用 GBK 来解码,并且不会有乱码。
UTF-8
UTF-16 统一采用两个字节表示一个字符,虽然在表示上非常简单方便,但是也有其缺点,有很大一部分字符用一个字节就可以表示的现在要两个字节表示,存储空间放大了一倍,在现在的网络带宽还非常有限的今天,这样会增大网络传输的流量,而且也没必要。而 UTF-8 采用了一种变长技术,每个编码区域有不同的字码长度。不同类型的字符可以是由 1~6 个字节组成。
来源:A5营销
[声明]
1.本博客内容均为网络转载,出于传递更多信息的目的;如转载稿涉及版权问题,请作者联系我们删除;
2.对于用户评论等信息,本网并不意味着赞同其观点或证实其内容的真实性;
3.对于不当转载或引用本网站内容而引起的任何纷争或其他损失,本网站不承担责任。
4.如果您发现本网站的内容侵犯了您的版权,请您的相关内容发至此邮箱【kefu@zmk188.com】,我们在确认后,会立即删除,