欢迎您访问程序员文章站本站旨在为大家提供分享程序员计算机编程知识!
您现在的位置是: 首页  >  IT编程

解决Python3中的中文字符编码的问题

程序员文章站 2022-06-03 18:09:50
python3中str默认为unicode的编码格式 unicode是一32位编码格式,不适合用来传输和存储,所以必须转换成utf-8,gbk等等 所以在python3...

python3中str默认为unicode的编码格式

unicode是一32位编码格式,不适合用来传输和存储,所以必须转换成utf-8,gbk等等

所以在python3中必须将str类型转换成bytes类型的

在python中使用encode的方式可以进行字符的编码

实际用法:

>>>a = "中国"
>>> a.encode("utf-8")
b'\xe4\xb8\xad\xe5\x9b\xbd'
>>> a.encode("gbk")
b'\xd6\xd0\xb9\xfa' 
 

解决Python3中的中文字符编码的问题解决Python3中的中文字符编码的问题

总结:

  1. python中str类型转bytes类型,相当与unicode转gbk,utf-8。。。类型
  2. b'代表字符编码格式为bytes,
  3. utf-8默认24位占3个8位16进制数
  4. gbk中国编码默认占16位2个8位16进制数字

以上所述是小编给大家介绍的解决python3中的中文字符编码的问题,希望对大家有所帮助