字符编码

1.在python2默认编码是ASCII, python3里默认是unicode

2.unicode 分为 utf-32(占4个字节),utf-16(占两个字节),utf-8(占1-4个字节), so utf-16就是现在最常用的unicode版本, 不过在文件里存的还是utf-8,因为utf8省空间

3.在py3中encode,在转码的同时还会把string 变成bytes类型,decode在解码的同时还会把bytes变回string


Unicode里中文英文每个字符都占两个字节,utf-8里中文字符占3个字节,英文字符占一个字节

,ascii码里一个英文字符两个字节


字符编码_第1张图片

详解

http://www.cnblogs.com/yuanchenqi/articles/5956943.html

http://www.diveintopython3.net/strings.html

你可能感兴趣的:(字符编码)