pandas 批量读取excel_pandas 循环读取文件夹下的 excel,并汇总到一张表格

该博客介绍如何使用pandas在Python中批量读取一个文件夹下的所有Excel文件,并只选择特定列进行合并,最后将所有数据整合到一张新的Excel表格中。通过遍历文件夹,对每个Excel文件读取第一行以确定所需列的位置,然后利用`pd.read_excel`读取指定列,同时将文件名作为附加信息加入数据,最后使用`pd.concat`进行数据拼接,并将结果保存到新的Excel文件。
摘要由CSDN通过智能技术生成
74f4b33e3ade0ddb35907d496287f4dc.png

-- coding:utf-8 –-

"""

利用 pandas 将多张 excel 表中的指定列数据合并成一张;因为原始的多张数据存在同样列名的数据,

因为原始多张 excel 是从 csv 文件转换股

并且我们只需要其中的部分列数据,所以进行指定列提取并汇总至 res 文件中

"""

import os

import pandas as pd

输入参数为 excel 表格所在目录

def to_one_excel(dir):

dfs = []

# 遍历文件目录,将所有表格表示为 pandas 中的 DataFrame 对象

# for root_dir, sub_dir, files in os.walk(r'' + dir): # 第一个为起始路径,第二个为起始路径下的文件夹,第三个是起始路径下的文件。

for root_dir, sub_dir, files in os.walk(dir): # 第一个为起始路径,第二个为起始路径下的文件夹,第三个是起始路径下的文件。

for file in files:

if file.endswith(‘xlsx’):

# 构造绝对路径

file_name = os.path.join(root_dir, file)

  • 1
    点赞
  • 4
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值