Python 编码转换与中文处理

最新推荐文章于 2023-04-19 21:42:14 发布

静妍

最新推荐文章于 2023-04-19 21:42:14 发布

阅读量596

点赞数

分类专栏： Python 文章标签：编码文件处理 python

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/xfyangle/article/details/60967639

版权

python 中的 unicode是让人很困惑、比较难以理解的问题. 这篇文章写的比较好，utf-8是 unicode的一种实现方式，unicode、gbk、gb2312是编码字符集.

py文件中的编码

Python 默认脚本文件都是 ANSCII 编码的，当文件中有非 ANSCII 编码范围内的字符的时候就要使用"编码指示"来修正一个 module 的定义中，如果.py文件中包含中文字符（严格的说是含有非anscii字符），则需要在第一行或第二行指定编码声明：# -*- coding=utf-8 -*- 或者 #coding=utf-8
其他的编码如：gbk、gb2312也可以；否则会出现:

SyntaxError: Non-ASCII character '\xe4' in file test.py on line 3, but no encoding declared; see http://www.python.org/peps/pep-0263.html for details

python中的编码与解码

先说一下python中的字符串类型，在python中有两种字符串类型，分别是 str 和 unicode，他们都是basestring的派生类；

str类型是一个包含Characters represent (at least) 8-bit bytes的序列；
unicode 的每个 unit 是一个 unicode obj;

在str的文档中有这样的一句话：

The string data type is also used to represent arrays of bytes, e.g., to hold data read from a file.

也就是说在读取一个文件的内容，或者从网络上读取到内容时，保持的对象为str类型；如果想把一个str转换成特定编码类型，需要把str转为Unicode,然后从unicode转为特定的编码类型如：utf-8、gb2312等。

python 编码转换函数

unicode 转为 gb2312,utf-8等,使用 encode(encoding)

# -*- coding=UTF-8 -*-
if __name__ == '__main__':
    s = u'中国'
    s_gb = s.encode('gb2312')

utf-8,GBK转换为 unicode 使用 unicode(s,encoding) 或者 s.decode(encoding)

最低0.47元/天解锁文章

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
Python 编码转换与中文处理

python 中的 unicode是让人很困惑、比较难以理解的问题. 这篇文章写的比较好，utf-8是 unicode的一种实现方式，unicode、gbk、gb2312是编码字符集.py文件中的编码Python 默认脚本文件都是 ANSCII 编码的，当文件中有非 ANSCII 编码范围内的字符的时候就要使用"编码指示"来修正一个 module 的定义中，如果.py文
复制链接

扫一扫

专栏目录

博客等级

码龄11年

44
原创

303
点赞

1293
收藏

272
粉丝

关注

私信

热门文章

分类专栏

Python 80篇
C/C++ 4篇
Java 3篇
PyQt 12篇
Qt
Linux 14篇
Django 2篇
MySQL 2篇
MongoDB
Git 4篇
Python爬虫 18篇
Windows 8篇
Go
网络安全 3篇

最新评论

Windows 新建文本文档快捷键设置
MFD_123: 有用，赞一个
Python使用HTTP代理 Proxy
Au33: 我就是在学习交易所api的时候遇到了阻碍，我猜应该是代理的问题。可以加你私信请教一下吗？
Kali Linux 系统安装详细教程（VMware14）
买不起面包: 问一个不成熟的问题，U盘可以安装kali吗？
Python 处理GBK编码转UTF-8读写乱码问题
弎番流水异乡人: 6666,完美解决小说网站上面的GBK问题
Linux环境C++编译报错：undefined reference to `std::ios_base::Init::Init()
红与黑St: 太感谢了！我在用VS开发Android动态共享库项目时也遇到了这些错误，在链接器的命令行中加入这个参数就解决了！

您愿意向朋友推荐“博客详情页”吗？

强烈不推荐
不推荐
一般般
推荐
强烈推荐

提交

最新文章

目录

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。