文章详情

短信预约-IT技能 免费直播动态提醒

请输入下面的图形验证码

提交验证

短信预约提醒成功

Python合并EXCEL数据(按行、按列、按sheet)

2023-09-14 10:49

关注

按行合并多个excel文件

import pandas as pdimport numpy as npimport osimport xlrd# 读取第一个文件df1 = pd.read_excel('C:/你的第一个文件.xlsx')# 读取第二个文件df2 = pd.read_excel('C:/你的第二个文件.xlsx')# 按行合并两个文件result = pd.concat([df1, df2])# 将结果保存到新的Excel文件result.to_excel('C:/hang.xlsx', index=False)

按列合并多个excel文件(多个excel文件行数需一致)

import pandas as pdimport numpy as npdf1= pd.read_excel("C:/你的第一个文件.xlsx")features1 = df1.iloc[:,1:].valuesdf2= pd.read_excel("C:/你的第二个文件.xlsx")features2 = df2.iloc[:,1:].valuesdf3= pd.read_excel("C:/你的第三个文件.xlsx")features3 = df3.iloc[:,1:].values#按列合并数据features = np.hstack((features1, features2, features3))print(features.shape)#打出来试试,这句不需要可以删掉dataSets = pd.DataFrame(features)dataSets.to_excel('C:/合并.xlsx')

改进版:把需要合并的excel表格放在一个文件夹,运行代码把该文件夹中的表格合并

这个代码直接粘过去用就行,改绿色的部分即可,注意要把文件都放一个文件夹里。

import pandas as pdimport numpy as npimport osimport xlwtimport xlrddef hebing(a):#基本函数( 取所有文件夹下所有子文件)    def getLine_num(d):         # 读取表格行数         filename = d         data = xlrd.open_workbook(filename)         table = data.sheets()[0]         line_num = table.nrows         print(line_num)         return line_num    dir = a #设置工作路径    #这段是为了自动识别行数,为了features1 = np.zeros((linenum-1,1))这一行初始化    filename_excel = []    for root, dirs, files in os.walk(dir):        for file in files:            #print(os.path.join(root,file))            filename_excel.append(os.path.join(root,file))            # excel转换成DataFrame            df = pd.read_excel(os.path.join(root,file))            #print(filename_excel)            linenum = getLine_num(os.path.join(root,file))#696                #新建列表,存放文件名(可以忽略,但是为了做的过程能心里有数,先放上)    filename_excel = []    #新建列表,存放每个文件数据框(每一个excel读取后存放在数据框)    frames = []    features1 = np.zeros((linenum-1,1))    for root, dirs, files in os.walk(dir):        for file in files:            filename_excel.append(os.path.join(root,file))            # excel转换成DataFrame            df = pd.read_excel(os.path.join(root,file),index_col = 1)            features = df.iloc[:,1:].values            features1 = np.hstack((features1,features))            frames.append(df)    #打印文件名    print(filename_excel)        features1= np.delete(features1,np.where(~features1.any(axis=0))[0], axis=1)# 寻找并删除全零列,这句不需要的可以删掉    dataSets = pd.DataFrame(features1)    dataSets.to_excel('C:/你想保存到的文件夹/按列合并后的文件名.xlsx')#以上部分是函数#以下调用函数即可    hebing('C:/存放待合并excel的文件夹')

按sheet合并,把一个文件里的多个sheet按列合并到一个sheet里面,生成一个新的文件夹。

import pandas as pdimport numpy as np    # 读取第一个sheetdf1 = pd.read_excel('待合并sheet.xlsx', sheet_name='sheet1',header = None)#header=none表示第一行不是表头,读的时候不把第一行去掉。同理,列是index_col# 读取第2个sheetdf2 = pd.read_excel('待合并sheet.xlsx', sheet_name='sheet2',header = None)# 读取第2个sheetdf3 = pd.read_excel('待合并sheet.xlsx', sheet_name='sheet3',header = None)#按列合并多个sheetfeatures = np.hstack((df1, df2, df3))print(features.shape)# 将结果保存到新的Excel文件dataSets = pd.DataFrame(features)dataSets.to_excel('C:/你要保存的文件名.xlsx', index = False,header = 0,sheet_name='合并后的sheet')

来源地址:https://blog.csdn.net/m0_60519450/article/details/129863451

阅读原文内容投诉

免责声明:

① 本站未注明“稿件来源”的信息均来自网络整理。其文字、图片和音视频稿件的所属权归原作者所有。本站收集整理出于非商业性的教育和科研之目的,并不意味着本站赞同其观点或证实其内容的真实性。仅作为临时的测试数据,供内部测试之用。本站并未授权任何人以任何方式主动获取本站任何信息。

② 本站未注明“稿件来源”的临时测试数据将在测试完成后最终做删除处理。有问题或投稿请发送至: 邮箱/279061341@qq.com QQ/279061341

软考中级精品资料免费领

  • 历年真题答案解析
  • 备考技巧名师总结
  • 高频考点精准押题
  • 2024年上半年信息系统项目管理师第二批次真题及答案解析(完整版)

    难度     813人已做
    查看
  • 【考后总结】2024年5月26日信息系统项目管理师第2批次考情分析

    难度     354人已做
    查看
  • 【考后总结】2024年5月25日信息系统项目管理师第1批次考情分析

    难度     318人已做
    查看
  • 2024年上半年软考高项第一、二批次真题考点汇总(完整版)

    难度     435人已做
    查看
  • 2024年上半年系统架构设计师考试综合知识真题

    难度     224人已做
    查看

相关文章

发现更多好内容

猜你喜欢

AI推送时光机
位置:首页-资讯-后端开发
咦!没有更多了?去看看其它编程学习网 内容吧
首页课程
资料下载
问答资讯