python在安装时,默认的编码是ascii,当程序中出现非ascii编码时,python的处理常常会报这样的错UnicodeDecodeError: 'ascii' codec can't decode byte 0x?? in
position 1: ordinal not in range(128),python没办法处理非ascii编码的,此时需要自己设置将python的默认编码,一般设置为utf8的编码格式。
我们可以用如下命令查看系统默认编码:
>>>import sys
>>>sys.getdefaultencoding()
'ascii'
系统显示的是ascii码,那么我们现在修改这个配置
>>>import sys
>>>reload(sys)
>>>sys.setdefaultencoding('utf8')
>>>sys.getdefaultencoding()
'utf8'
另一个方案是在python的Lib\site-packages文件夹下新建一个sitecustomize.py,内容为:
Python代码
# encoding=utf8
import sys
reload(sys)
sys.setdefaultencoding('utf8')
新版本site-packages这个文件夹不存在,可以修改文件site.py这个文件
setencoding() 函数内部修改将ascii改为utf8
此时重启python解释器,执行sys.getdefaultencoding(),发现编码已经被设置为utf8的了,多次重启之后,效果相同,这是因为系统在python启动的时候,自行调用该文
件,设置系统的默认编码,而不需要每次都手动的加上解决代码,属于一劳永逸的解决方法。
另外有一种解决方案是在程序中所有涉及到编码的地方,强制编码为utf8,即添加代码encode("utf8"),这种方法并不推荐使用,因为一旦少写一个地方,将会导致大量的
错误报告,我曾经遇到这种情况,错误日志压缩之后尚有70多K,全都是这一个问题,让人有很崩溃的感觉。
position 1: ordinal not in range(128),python没办法处理非ascii编码的,此时需要自己设置将python的默认编码,一般设置为utf8的编码格式。
我们可以用如下命令查看系统默认编码:
>>>import sys
>>>sys.getdefaultencoding()
'ascii'
系统显示的是ascii码,那么我们现在修改这个配置
>>>import sys
>>>reload(sys)
>>>sys.setdefaultencoding('utf8')
>>>sys.getdefaultencoding()
'utf8'
另一个方案是在python的Lib\site-packages文件夹下新建一个sitecustomize.py,内容为:
Python代码
# encoding=utf8
import sys
reload(sys)
sys.setdefaultencoding('utf8')
新版本site-packages这个文件夹不存在,可以修改文件site.py这个文件
setencoding() 函数内部修改将ascii改为utf8
此时重启python解释器,执行sys.getdefaultencoding(),发现编码已经被设置为utf8的了,多次重启之后,效果相同,这是因为系统在python启动的时候,自行调用该文
件,设置系统的默认编码,而不需要每次都手动的加上解决代码,属于一劳永逸的解决方法。
另外有一种解决方案是在程序中所有涉及到编码的地方,强制编码为utf8,即添加代码encode("utf8"),这种方法并不推荐使用,因为一旦少写一个地方,将会导致大量的
错误报告,我曾经遇到这种情况,错误日志压缩之后尚有70多K,全都是这一个问题,让人有很崩溃的感觉。