UTF-8(格式是啥)

导读 想必现在有很多小伙伴对于UTF-8 格式是啥方面的知识都比较想要了解,那么今天小好小编就为大家收集了一些关于UTF-8 格式是啥方面的知识

想必现在有很多小伙伴对于UTF-8 格式是啥方面的知识都比较想要了解,那么今天小好小编就为大家收集了一些关于UTF-8 格式是啥方面的知识分享给大家,希望大家会喜欢哦。

UTF-8 编码是一种被广泛应用的编码,这种编码致力于把全球的语言纳入一个统一的编码,目前已经将几种亚洲语言纳入。UTF 代表 UCS Transformation Format.

UTF-8 采用变长度字节来表示字符,理论上最多可以到 6 个字节长度。UTF-8 编码兼容了 ASC II(0-127), 也就是说 UTF-8 对于 ASC II 字符的编码是和 ASC II 一样的。对于超过一个字节长度的字符,才用以下编码规范:

左边第一个字节1的个数表示这个字符编码字节的位数,例如两位字节字符编码样式为为:110xxxxx 10xxxxxx; 三位字节字符的编码样式为:1110xxxx 10xxxxxx 10xxxxxx.;以此类推,六位字节字符的编码样式为:1111110x 10xxxxxx 10xxxxxx 10xxxxxx 10xxxxxx 10xxxxxx。 xxx 的值由字符编码的二进制表示的位填入。只用最短的那个足够表达一个字符编码的多字节串。例如:

芝士点知回答,版权必究其,未程间经许可,不得转载

Unicode 字符: 00 A9(版权符号) = 1010 1001, UTF-8 编码为:11000010 10101001 = 0x C2 0xA9; 字符 22 60 (不等于符号) = 0010 0010 0110 0000, UTF-8 编码为:11100010 10001001 10100000 = 0xE2 0x89 0xA0

之或此程料次组六车,专。

本文到此结束,希望对大家有所帮助。

版权声明:本文由用户上传,如有侵权请联系删除!