龙空技术网

教你用Python批量实现文件夹下所有Excel文件的第二张表合并

CDA数据分析师 751

前言:

今天看官们对“python合并数据框”可能比较关怀,你们都想要了解一些“python合并数据框”的相关知识。那么小编在网摘上收集了一些有关“python合并数据框””的相关资讯,希望同学们能喜欢,你们快快来了解一下吧!

作者:Python进阶者

来源:Python爬虫与数据挖掘

问题:想向大佬们求教个问题,如果我有这样的需求,如何完成:

1、将A文件中名为a的sheet和B文件中名为b的sheet合并到一个sheet中去。

2、将文件夹下所有文件的第二张表合并。我做出来了,核心部分没有用pandas,而且逻辑比较繁琐。想求一用pandas解决的简洁方案。

1、解决思路

问题一和问题二的思路都挺常规的,就是取对应的表格,然后进行合并即可,这里仍然使用pandas来进行实现!

2、解决方法

问题一:将A文件中名为a的sheet和B文件中名为b的sheet合并到一个sheet中去。

这里基于之前【(这是月亮的背面)】提供的代码,我稍微做了些修改,代码如下:

# coding: utf-8# 将A文件中名为a的sheet和B文件中名为b的sheet合并到一个sheet中去from pathlib import Pathimport pandas as pdpath = r'E:\PythonCrawler\有趣的代码\Python自动化办公\将A文件中名为a的sheet和B文件中名为b的sheet合并到一个sheet中去'data_ex1 = pd.read_excel('ex1.xlsx', sheet_name='df1')data_ex2 = pd.read_excel('ex2.xlsx', sheet_name='df2')result = pd.concat([data_ex1, data_ex2], ignore_index=True)result.to_excel('将A文件中名为a的sheet和B文件中名为b的sheet合并到一个sheet中去.xlsx', index=False, encoding='utf-8')print('添加和合并完成!')

代码运行之后,会生成一个新的excel文件,如下图所示:

合并的结果如下图所示:

完成之后,我发给【有点意思】大佬看,不过这个答案勉强符合他的意思,他后来自己也写了一个代码,能满足自己的需求,这里发给大家看看。

问题二:将文件夹下所有文件的第二张表合并

这里基于之前【(这是月亮的背面)】提供的代码,我稍微做了些修改,代码如下:

# coding: utf-8# 合并所有表格中的第二张表格from pathlib import Pathimport pandas as pdpath = Path(r'E:\PythonCrawler\有趣的代码\Python自动化办公\将文件夹下所有文件的第二张表合并')data_list = []for i in path.glob("*.xls*"):    # data = pd.read_excel(i, sheet_name='df2')    data = pd.read_excel(i, sheet_name=1)    data_list.append(data)result = pd.concat(data_list, ignore_index=True)result.to_excel(path.joinpath('取所有excel表的df2表进行合并.xlsx'), index=False, encoding='utf-8')print('添加和合并完成!')

代码运行之后,会生成一个新的excel文件,如下图所示:

合并的结果如下图所示:

细心的小伙伴可能发现代码中的第9行,我其实是注释了,一开始我测试的表格,命名规则很有规范,每个工作簿都有df1,df2,df3三张表格,所以在合并的时候直接指定了表名,但是这样写就会有问题,万一有个表格中没有df2工作表,这个代码肯定就会报错了,所以在【(这是月亮的背面)】大佬的指导下,使用了sheet_name=1参数,以索引来定位第二张表格,恰到好处,前提条件是你的Excel表格中必须要有第二张表格,否则就会出现下图的错误。

3、总结

我是Python进阶者。本文基于粉丝针对Python处理Excel指定表格合并的提问,给出了一个利用Python基础+pandas处理的解决方案。

标签: #python合并数据框 #python 合并sheet