python读取pdf并写入excel_Python读取pdf表格写入excel的方法

最新推荐文章于 2024-05-24 17:41:56 发布

景澄

最新推荐文章于 2024-05-24 17:41:56 发布

阅读量1.3k

点赞数 1

文章标签： python读取pdf并写入excel

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/weixin_42326661/article/details/113517352

版权

背景

今天突然想到之前被要求做同性质银行的数据分析。妈耶！十几个银行，每个银行近5年的财务数据，而且财务报表一般都是 pdf 的，我们将 pdf 中表的数据一个个的拷贝到 excel 中，再借助 excel 去进行求和求平均等聚合函数操作，完事了还得把求出来的结果再统一 CV 到另一张表中，进行可视化分析…

当然，那时风流倜傥的老Amy 还熟练的玩转着 excel ，也是个秀儿~ 今天就思索着，如果当年我会 Python 是不是可以让我成为班级最靓的崽！用技术占领高地，HHH，所以今天我来了，希望可以帮助大家解决同性质的问题。

开始学习叭

避免CV大法

pdf 文件的表格的数据可以复制，但是这是一项非常繁琐的事情。所以我首先考虑的是，Python 可否帮助我们高效且规范地读取 pdf 中的表格数据。所以一顿的检索，发现了一个比较优质处理 pdf 的库：pdfplumber，当然这个库需要大家 pip install pdfplumber 去进行安装。以及详细使用可参考全球最大基友社区：https://github.com/jsvine/pdfplumber

步骤：

导入 pdfplumber 库

通过 pdfplumber.open() 函数获取 mt2018.pdf 文件对象

通过该对象.pages 获取 pdf 每页的对象，截取我们需要的页对象即可

通过页对象.extract_tables() 获取表格数据(若需要获取文本：页对象.extract_text())

代码实现：

import pdfplumber

# 获取 pdf

最低0.47元/天解锁文章

关注

1
点赞
踩
10

收藏

觉得还不错? 一键收藏
0
评论
python读取pdf并写入excel_Python读取pdf表格写入excel的方法

背景今天突然想到之前被要求做同性质银行的数据分析。妈耶！十几个银行，每个银行近5年的财务数据，而且财务报表一般都是 pdf 的，我们将 pdf 中表的数据一个个的拷贝到 excel 中，再借助 excel 去进行求和求平均等聚合函数操作，完事了还得把求出来的结果再统一 CV 到另一张表中，进行可视化分析…当然，那时风流倜傥的老Amy 还熟练的玩转着 excel ，也是个秀儿~ 今天就思索着，如果...
复制链接

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。