一、需求描述
编写一个Python程序,每次下载压缩包形式的文件后,自动将内部文件解压到当前文件夹后将压缩包删除,通过本案例可以学到的知识点:
os 模块综合应用
glob 模块综合应用
利用 gzip zipfile rarfile tarfile 模块解压文件
二、步骤分析和前置知识
码代码之前需要将复杂问题解释成多个明确的要求,即这个程序实现的逻辑为:
-
定时检测某个文件夹(如
download
文件夹)是否存在压缩文件 -
如果有新出现的压缩文件则将其解压到当前文件夹内的新文件夹中 删除压缩文件
-
提到压缩文件就要分不同压缩格式进行讨论,主要有以下4种:
提到压缩文件就要分不同压缩格式进行讨论,主要有以下4种:
.gz: 即gzip,通常只能压缩一个文件
.tar: 本质上不是压缩工具而是打包工具,可以跟.gz配合形成.tar.gz的打包压缩格式
.zip: 和.tar.gz很类似但可以打包压缩多个文件
.rar: 打包压缩文件,最初用于DOS
因此,文件是否为压缩文件的判断逻辑可以如下:
-
建立一个含压缩包后缀的列表
compressed_lst = ['gz', 'tar', 'zip', 'rar']
-
目标文件夹下的所有文件名运行
filename.split(.)[-1]
获取后缀名 -
判断后缀名是否在
compressed_lst
中,如果存在则运行后续的解压代码 -
如果是以
gz
结尾的文件,解压后需要再次判断是否是以.tar
结尾,并进行相应处理
不同压缩文件的解压代码各不相同,在后续代码操作中具体展开。
码字不易废话两句:有需要python学习资料的或者有技术问题交流 “点击” 即可
三、代码实现
首先是获取download
文件夹下所有文件的文件名
import glob
import os
path = r'C:\xxxx\download'
file_lst = glob.glob(path + '/*')
# 列表推导式
filename_lst = [os.path.basename(i) for i in file_lst]
print(filename_lst)
接下来根据文件的后缀名判断是否需要压缩,先看一下代码框架
for i in filename_lst:
if '.' in i:
# 获取后缀名
suffix = i.split('.')[-1]
# 逐个将后缀名和各格式的压缩后缀匹配
if suffix == 'gz':
pass
if ...: # 再次判断新产生的文件名是否以 .tar 结尾
pass
if suffix == 'tar':
pass
if suffix == 'zip':
pass
if suffix == 'rar':
pass
这里有2个注意点:
-
有些文件没有后缀名,因此可能不存在
.
,这时用filename.split('.')[-1]
会报错,因此需要先判断 -
以
.gz
结尾的文件,解压后需要再次判断是否是以.tar
结尾,然后我们就可以分别将四种压缩文件的解压代码写成函数,符合时候单独调用即可
处理.gz
文件
import gzip
def ungz(filename):
filename = filename[:-3] # gz文件的单文件解压就是去掉 filename 后面的 .gz
gz_file