码迷,mamicode.com
首页 > 其他好文 > 详细

字符串编码与转码

时间:2017-09-05 10:02:25      阅读:131      评论:0      收藏:0      [点我收藏+]

标签:pytho   com   border   one   str   padding   als   ack   默认   

技术分享

需知:

1.在python2默认编码是ASCII, python3里默认是unicode

2.unicode 分为 utf-32(占4个字节),utf-16(占两个字节),utf-8(占1-4个字节), so utf-16就是现在最常用的unicode版本, 不过在文件里存的还是utf-8,因为utf8省空间

3.在py3中encode,在转码的同时还会把string 变成bytes类型,decode在解码的同时还会把bytes变回string

 

 

python中,字符编码默认为Unicode,因此,在进行字符编码解码时:
str = ‘你好‘ #str是Unicode
str_to_gbk = str.encode(‘gbk‘) #这里解码即可,即是Unicode解码为gbk
此时str_to_gbk是GBK编码,再进行编码时
需要decode成Unicode,再encode成其他格式
例:
gbk_to_utf8 = str_to_gbk.decode(‘gbk‘).encode(‘utf-8‘)
#先转化为Unicode,再转化为utf-8
 
 
 
 

<wiz_tmp_tag id="wiz-table-range-border" contenteditable="false" style="display: none;">

字符串编码与转码

标签:pytho   com   border   one   str   padding   als   ack   默认   

原文地址:http://www.cnblogs.com/limich/p/7476620.html

(0)
(0)
   
举报
评论 一句话评论(0
登录后才能评论!
© 2014 mamicode.com 版权所有  联系我们:gaon5@hotmail.com
迷上了代码!