0. 前言
从网页爬下来的大量数据需要清洗?
成堆的科学实验数据需要导入 Excel 进行分析?
有成堆的表格等待统计?
作为人生苦短的 Python 程序员,该如何优雅地操作 Excel?
得益于前人的辛勤劳作,Python 处理 Excel 已有很多现成的轮子,使用较多的有:
xlwings
提醒及注意:
xlutils 仅支持 xls 文件,即2003以下版本;
win32com 与 DataNitro 仅支持 windows 系统;
xlwings 安装成功后,如果运行提示报错“ImportError: no module named win32api”,请再安装 pypiwin32 或者 pywin32 包;
win32com 不是独立的扩展库,而是集成在其他库中,安装 pypiwin32 或者 pywin32 包即可使用;
DataNitro 是 Excel 的插件,安装需到官网下载。
2. 文档操作
虽然大家都是操作 Excel,但即使最基本的新建文件、修改文件、保存文件等功能,在不同的库中也存在差异。比如 xlsxwriter 并不支持打开或修改现有文件,xlwings 不支持对新建文件的命名,DataNitro 作为 Excel 插件需依托于软件本身,pandas 新建文档需要依赖其他库等等。