print(strhtml.text)报错记录
原因:网页的数据应该是’utf-8’编码,你爬网页的时候会把它转化成Unicode,出问题的是在print()这儿,对于print()这个函数,他需要把内容转化为’gbk’编码才能显示出来。
解决办法:在转化后的Unicode编码的string后面,加上 .encode(‘GBK’,‘ignore’).decode(‘GBk’) 也就是先用gbk编码,忽略掉非法字符,然后再译码。
x=a.encode(‘gbk’,‘ignore’)
print(x)
print(x.decode(‘gbk’))
成功!