「@Author:Runsen」
任何语言都离不开对文件的操作,那么Python语言是如何来操作和管理文件的。
编码方式
编码方式的历史大致为ASCII
->gb2312
->unicode
->utf-8
,期间具体详细信息可以百度
来个编码解码的小例子先,记住中文可以进行GBK
和utf-8
编码,在GBk
一个中文字符对应两个字节,在utf-8
一个中文字符对应三个字节,中文不能进行ASCII
编码。
>>> '刘润森'.encode('GBK')
b'\xc1\xf5\xc8\xf3\xc9\xad'
>>> '刘润森'.encode('ascii')
Traceback (most recent call last):
File "", line 1, in
UnicodeEncodeError: 'ascii' codec can't encode characters in position 0-2: ordinal not in range(128)
>>> 'Runsen'.encode('ascii')
b'Runsen'
>>> "刘润森".encode('utf-8')
b'\xe5\x88\x98\xe6\xb6\xa6\xe6\xa3\xae'
>>> '刘润森'.encode('GBK').decode('GBK')
'刘润森'
>>> '刘润森'.encode('GBK').decode('utf-8')
UnicodeDecodeError: 'utf-8' codec can't decode byte 0xc1 in position 0: invalid start byte
如果编码解码格式不一致可能会出现乱码,encode表示编码,decode表示解码。
文件操作的API
下面是Python文件操作的具体的API。
方法 | 含义 |
---|---|
open | 打开 |