python 写入文件时,报错:UnicodeEncodeError: 'gbk' codec can't encode character '\xa0' in position 1806: ille

最近用到python 爬取智联招聘上的网页,想把页面保存本地:

def writeintofile(filename, str):
    # 打开文件
    fo = open(filename, 'w')      # 写的方式打开文件
    print("文件名: ", fo.name)
    # 在文件末尾写入一行
    fo.write(str)

    # 关闭文件
    fo.close()

报出错误:UnicodeEncodeError: ‘gbk’ codec can’t encode character ‘\xa0’ in position 1806: illegal multibyte sequence

原因如下:
1.‘gbk’ codec can’t encode character :说明是将Unicode字符编码为GBK时候出现了问题,可能是本身Unicode类型的字符中,包含了一些无法转换为GBK编码的一些字符;

2.gbk无法转换’\xa0’字符,所以在转换前需要将“\xa0”替换掉;使用string.replace(u’\xa0’, u’ ‘);
因此,我们使用:

fo.write(str.replace(u'\xa0', u'')) 

即可解决问题;

另外一种解决办法,在gbk解码时忽略掉不能解码的数据:

fo.write(content.encode("gbk", 'ignore').decode("gbk", "ignore"))

或者采用如下方式:

fo = open(filename, 'w', encoding="utf-8")  
fo.write(str)

三种解决方法都成功。

评论 2
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值