python 通过 HTTP 交互处理数据的时候,url 里面的中文以及特殊字符要做处理的,当url地址含有中文,或者参数有中文的时候,这个算是很正常了,但是把这样的url作为参数传递的时候(最常见的callback),需要把一些中文甚至'/'做一下编码转换。
一、urlencode
urllib库里面有个urlencode函数,可以把key-value这样的键值对转换成我们想要的格式,返回的是a=1&b=2这样的字符串,比如:
>>> from urllib import urlencode
>>> data = {
... 'a': 'China',
... 'name': '中国'
... }
>>> print urlencode(data)
a=China&name=%E4%B8%AD%E5%9B%BD
如果只想对一个字符串进行urlencode转换,怎么办?urllib提供另外一个函数:quote()
>>> from urllib import quote
>>> quote('中国')
'
%E4%B8%AD%E5%9B%BD
'
二、urldecode
当urlencode之后的字符串传递过来之后,接受完毕就要解码了——urldecode。urllib提供了unquote()这个函数,可没有urldecode()这个函数!!!
>>> from urllib import unquote
>>> print unquote('
%E4%B8%AD%E5%9B%BD
')
中国