编码总结.

unicode是字符集,指的是编码类型,规定世界上的文字的具体值.

utf8,utf16这些指的是编码格式,即存储、传输文字的格式.规定了unicode字符集以怎样形式展现,用几个字节来存放unicode的一个字的2进制数据,每个字节里的bit以怎样的形式存储.


FE FF UTF-16/UCS-2, little endian 
FF FE UTF-16/UCS-2, big endian 
FF FE 00 00 UTF-32/UCS-4, little endian. 

UTF-16与UCS-2的关系
UTF-16可看成是UCS-2的父集。在没有辅助平面字符(surrogate code points)前,UTF-16与UCS-2所指的是同一的意思。但当引入辅助平面 字符后,就称为UTF-16了。现在若有软件声称自己支援UCS-2编码,那其实是暗指它不能支援在UTF-16中超过2bytes的字集。对于小于0x10000的UCS码,UTF-16编码就等于UCS码。

你可能感兴趣的:(编码总结.)