这是Python的编码问题,设置python的默认编码为utf8

python安装目录:/etc/python2.x/sitecustomize.py
1importsys
2reload(sys)
3sys.setdefaultencoding('utf-8')
4try:
5importapport_python_hook
6exceptImportError:
7pass
8else:
9apport_python_hook.install()
如果在windows下:
可以在Python安装目录下的Lib/site-packages目录中,新建一个sitecustomize.py文件(也可以建在其它地方,然后手工导入,建在这里,每次启动Python的时候设置将自动生效),内容如下:
1importsys
2sys.setdefaultencoding('utf-8') #set default encoding to utf-8
然后可以查看到改变已经生效
1>>> importsys
2>>> sys.getdefaultencoding()
3'utf-8'
此时运行程序,如果仍然报告之前的错误,只需要显示地设定输出的编码
1prints.encode('utf-8')

就可以看到正确显示。


MIMEText(body, _charset='utf-8'),可以指定编码集



python在安装时,默认的编码是ascii,当程序中出现非ascii编码时,python的处理常常会报这样的错UnicodeDecodeError: 'ascii' codec can't decode byte 0x?? in position 1: ordinal not in range(128),python没办法处理非ascii编码的,此时需要自己设置将python的默认编码,一般设置为utf8的编码格式。

查询系统默认编码可以在解释器中输入以下命令:

Python代码   收藏代码
  1. >>>sys.getdefaultencoding()  

设置默认编码时使用:

Python代码   收藏代码
  1. >>>sys.setdefaultencoding('utf8')  

可能会报AttributeError: 'module' object has no attribute 'setdefaultencoding'的错误,执行reload(sys),在执行以上命令就可以顺利通过。

此时在执行sys.getdefaultencoding()就会发现编码已经被设置为utf8的了,但是在解释器里修改的编码只能保证当次有效,在重启解释器后,会发现,编码又被重置为默认的ascii了,那么有没有办法一次性修改程序或系统的默认编码呢。


有2种方法设置python的默认编码:

一个解决的方案在程序中加入以下代码:

Python代码   收藏代码
  1. import sys  

  2. reload(sys)  

  3. sys.setdefaultencoding('utf8')  

另一个方案是在python的Lib\site-packages文件夹下新建一个sitecustomize.py,内容为:

Python代码   收藏代码
  1. # encoding=utf8

  2. import sys  

  3. reload(sys)  

  4. sys.setdefaultencoding('utf8')  

此时重启python解释器,执行sys.getdefaultencoding(),发现编码已经被设置为utf8的了,多次重启之后,效果相同,这是因为系统在python启动的时候,自行调用该文件,设置系统的默认编码,而不需要每次都手动的加上解决代码,属于一劳永逸的解决方法。


另外有一种解决方案是在程序中所有涉及到编码的地方,强制编码为utf8,即添加代码encode("utf8"),这种方法并不推荐使用,因为一旦少写一个地方,将会导致大量的错误报告,我曾经遇到这种情况,错误日志压缩之后尚有70多K,全都是这一个问题,让人有很崩溃的感觉。