python中文和unicode字符串之间的互相转换

weixin_34149796

于 2014-08-05 09:56:30 发布

阅读量306

点赞数

文章标签： python

原文链接：http://blog.51cto.com/wangyincol/1535794

版权

首先：中文->unicode字符串

import chardet

import codecs

>>> a = "我是一个中国人"
>>> a
'\xce\xd2\xca\xc7\xd2\xbb\xb8\xf6\xd6\xd0\xb9\xfa\xc8\xcb'

>>> chardet.detect(a)
{'confidence': 0.99, 'encoding': 'GB2312'}
>>> b = a.decode('GB2312')

>>> b
u'\u6211\u662f\u4e00\u4e2a\u4e2d\u56fd\u4eba' -->但是我们往往不想要外面的u

>>> c =repr(b)
>>> c
"u'\\u6211\\u662f\\u4e00\\u4e2a\\u4e2d\\u56fd\\u4eba'"

>>> d = c[2:-1]
>>> d
'\\u6211\\u662f\\u4e00\\u4e2a\\u4e2d\\u56fd\\u4eba'

>>> print d
\u6211\u662f\u4e00\u4e2a\u4e2d\u56fd\u4eba

然后是 unicode ->中文：

>>> a = '\u9a8c'
>>> a
'\\u9a8c'

>>> b = 'u'+'\''+a+'\''
>>> b
"u'\\u9a8c'"
>>> c = eval(b)
>>> c
u'\u9a8c'
>>> print c
验

转载于:https://blog.51cto.com/wangyincol/1535794

weixin_34149796

关注

0
点赞
踩
1

收藏

觉得还不错? 一键收藏
0
评论
复制链接

分享到 QQ

分享到新浪微博

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。