转 Python——UnicodeEncodeError: 'ascii' codec can't encode/decode characters

Posted njczy2010

tags:

篇首语:本文由小常识网(cha138.com)小编为大家整理,主要介绍了转 Python——UnicodeEncodeError: 'ascii' codec can't encode/decode characters相关的知识,希望对你有一定的参考价值。

转自:

http://blog.csdn.net/zuyi532/article/details/8851316

我是写爬虫的时候遇到的问题,百度了一下,先贴解决方案:

在代码中加入:

 

import sys  
reload(sys)  
sys.setdefaultencoding(utf8)   

 

初学Python被编码格式搞的很头大,以下bug是遇到的编码问题之一:

【BUG】UnicodeEncodeError: ‘ascii‘ codec can‘t encode characters in position 0-15: ordinal not in range(128)或者UnicodeDecodeError: ‘ascii‘ codec can‘t decode byte 0x?? in position 1: ordinal not in range(128)

在python在安装时,默认的编码是ascii,当程序中出现非ascii编码时,python的处理常常会报这样的错,python没办法处理非ascii编码的,此时需要自己设置将python的默认编码,一般设置为utf8的编码格式。

 

查询系统默认编码可以在解释器中输入以下命令:

>>>sys.getdefaultencoding()  

 

设置默认编码时使用:

Python代码  技术分享
>>>sys.setdefaultencoding(utf8)  

 

 可能会报AttributeError: ‘module‘ object has no attribute ‘setdefaultencoding‘的错误,执行reload(sys),在执行以上命令就可以顺利通过。

此时在执行sys.getdefaultencoding()就会发现编码已经被设置为utf8的了,但是在解释器里修改的编码只能保证当次有效,在重启解释器后,会发现,编码又被重置为默认的ascii了,那么有没有办法一次性修改程序或系统的默认编码呢。

 

有2种方法设置python的默认编码:

一个解决的方案在程序中加入以下代码:

import sys  
reload(sys)  
sys.setdefaultencoding(utf8)   

 

 另一个方案是在python的Lib\site-packages文件夹下新建一个sitecustomize.py,内容为:

# encoding=utf8  
import sys  
  
reload(sys)  
sys.setdefaultencoding(utf8)   

 

此时重启python解释器,执行sys.getdefaultencoding(),发现编码已经被设置为utf8的了,多次重启之后,效果相同,这是因为系统在python启动的时候,自行调用该文件,设置系统的默认编码,而不需要每次都手动的加上解决代码,属于一劳永逸的解决方法。

 

另外有一种解决方案是在程序中所有涉及到编码的地方,强制编码为utf8,即添加代码encode("utf8"),这种方法并不推荐使用,因为一旦少写一个地方,将会导致大量的错误报告。

【转】http://shirley-ren.iteye.com/blog/1018750

以上是关于转 Python——UnicodeEncodeError: 'ascii' codec can't encode/decode characters的主要内容,如果未能解决你的问题,请参考以下文章

python 图像转矩阵,矩阵转图像

python的图片转字符

Python实现PDF 转txt 和html转txt

python图片转字符画

python自动化测试——中文转拼音,转英文

python图像视频转字符画