0

0

Pandas 多数据框横向合并与 Excel 透视导出完整教程

花韻仙語

花韻仙語

发布时间:2026-01-23 19:29:12

|

336人浏览过

|

来源于php中文网

原创

Pandas 多数据框横向合并与 Excel 透视导出完整教程

本文详解如何将多个结构不一但共享索引列(如 'header')的 pandas dataframe 合并为统一宽表,自动对齐所有指标列(val1–val9),填充缺失值,并导出至 excel 供后续 pivottable 分析。

在实际数据分析工作中,常需整合多个函数生成的异构结果表(如不同模块的统计摘要),这些表虽列名、行数各异,但都包含一个逻辑主键列(如 'Header')和若干数值指标列(如 'Val1', 'Val5', 'Val7' 等)。目标是将其“拼接”成一张以 Header 为行索引、所有 ValX 列为列名的稀疏宽表,缺失位置补零,最终导出 Excel 以便人工创建透视表(PivotTable)——这正是 Excel 用户最熟悉的交互式分析起点。

核心思路是:统一索引 + 横向拼接 + 缺失填充 + Excel 导出。以下为推荐实现方案(基于 pd.concat(..., axis=1)):

✅ 正确做法:以 Header 为索引横向合并(推荐)

import pandas as pd

# 示例数据(模拟多函数输出)
data1 = {'Header':['L1','L2','L3'], 'Val1':[100.0,200.0,300.0], 'Val2':[400.0,500.0,600.0], 'Val3':[700.0,800.0,900.0]}
data2 = {'Header':['L5','L6'], 'Val5':[1000.0,1100.0], 'Val6':[1300.0,1400.0]}
data3 = {'Header':['L7','L8','L9','L10'], 'Val7':[1900.0,2000.0,2100.0,2200.0], 'Val8':[2900.0,2300.0,2400.0,2800.0], 'Val9':[3500.0,3600.0,3700.0,3900.0]}

df1, df2, df3 = pd.DataFrame(data1), pd.DataFrame(data2), pd.DataFrame(data3)
dfs = [df1, df2, df3]

# 关键步骤:每张表设 Header 为索引 → 沿列方向拼接 → 清除索引名 → 填充 NaN 为 0(整型)
result = (
    pd.concat([df.set_index('Header') for df in dfs], axis=1)
    .rename_axis(None)  # 移除行索引名称(避免 Excel 中显示 "Header" 标题)
    .fillna(0, downcast='int')  # 填 0 并自动转为 int(更整洁)
)

print(result)

输出即为题目所求格式:

抖云猫AI论文助手
抖云猫AI论文助手

一款AI论文写作工具,最快 2 分钟,生成 3.5 万字论文。论文可插入表格、代码、公式、图表,依托自研学术抖云猫大模型,生成论文具备严谨的学术专业性。

下载
     Val1  Val2  Val3  Val5  Val6  Val7  Val8  Val9
L1    100   400   700     0     0     0     0     0
L2    200   500   800     0     0     0     0     0
L3    300   600   900     0     0     0     0     0
L5      0     0     0  1000  1300     0     0     0
L6      0     0     0  1100  1400     0     0     0
L7      0     0     0     0     0  1900  2900  3500
L8      0     0     0     0     0  2000  2300  3600
L9      0     0     0     0     0  2100  2400  3700
L10     0     0     0     0     0  2200  2800  3900

? 注意事项与进阶场景

  • 重复 Header 处理:若不同数据框含相同 'Header' 值(如 L1 出现在 df1 和 df2 中),直接 concat 会引发索引冲突。此时应改用 groupby('Header').sum() 聚合(见答案中最后一段代码),确保同名行数值相加。
  • 列顺序控制:concat(..., axis=1) 默认按输入列表顺序排列列。如需固定列序(如 Val1→Val2→...→Val9),可在合并后显式重排:
    all_cols = ['Val1','Val2','Val3','Val5','Val6','Val7','Val8','Val9']
    result = result.reindex(columns=all_cols, fill_value=0)
  • Excel 导出(含格式优化)
    with pd.ExcelWriter("consolidated_pivot_ready.xlsx", engine="openpyxl") as writer:
        result.to_excel(writer, sheet_name="PivotSource", index=True)
        # 可选:自动调整列宽(需 openpyxl)
        worksheet = writer.sheets["PivotSource"]
        for column in worksheet.columns:
            max_length = 0
            column_letter = column[0].column_letter
            for cell in column:
                try:
                    if len(str(cell.value)) > max_length:
                        max_length = len(str(cell.value))
                except:
                    pass
            adjusted_width = min(max_length + 2, 50)
            worksheet.column_dimensions[column_letter].width = adjusted_width
  • 性能提示:对大量数据框,避免循环中反复 concat;优先使用列表推导式一次性构建,再调用单次 pd.concat。

该方法生成的 Excel 表格可直接被 Excel 的「插入 → 数据透视表」识别:行标签选 Header,数值字段勾选全部 Val* 列,即可自由拖拽分析——真正实现 Python 预处理与 Excel 交互分析的无缝衔接。

相关专题

更多
python开发工具
python开发工具

php中文网为大家提供各种python开发工具,好的开发工具,可帮助开发者攻克编程学习中的基础障碍,理解每一行源代码在程序执行时在计算机中的过程。php中文网还为大家带来python相关课程以及相关文章等内容,供大家免费下载使用。

772

2023.06.15

python打包成可执行文件
python打包成可执行文件

本专题为大家带来python打包成可执行文件相关的文章,大家可以免费的下载体验。

662

2023.07.20

python能做什么
python能做什么

python能做的有:可用于开发基于控制台的应用程序、多媒体部分开发、用于开发基于Web的应用程序、使用python处理数据、系统编程等等。本专题为大家提供python相关的各种文章、以及下载和课程。

765

2023.07.25

format在python中的用法
format在python中的用法

Python中的format是一种字符串格式化方法,用于将变量或值插入到字符串中的占位符位置。通过format方法,我们可以动态地构建字符串,使其包含不同值。php中文网给大家带来了相关的教程以及文章,欢迎大家前来阅读学习。

679

2023.07.31

python教程
python教程

Python已成为一门网红语言,即使是在非编程开发者当中,也掀起了一股学习的热潮。本专题为大家带来python教程的相关文章,大家可以免费体验学习。

1385

2023.08.03

python环境变量的配置
python环境变量的配置

Python是一种流行的编程语言,被广泛用于软件开发、数据分析和科学计算等领域。在安装Python之后,我们需要配置环境变量,以便在任何位置都能够访问Python的可执行文件。php中文网给大家带来了相关的教程以及文章,欢迎大家前来学习阅读。

570

2023.08.04

python eval
python eval

eval函数是Python中一个非常强大的函数,它可以将字符串作为Python代码进行执行,实现动态编程的效果。然而,由于其潜在的安全风险和性能问题,需要谨慎使用。php中文网给大家带来了相关的教程以及文章,欢迎大家前来学习阅读。

579

2023.08.04

scratch和python区别
scratch和python区别

scratch和python的区别:1、scratch是一种专为初学者设计的图形化编程语言,python是一种文本编程语言;2、scratch使用的是基于积木的编程语法,python采用更加传统的文本编程语法等等。本专题为大家提供scratch和python相关的文章、下载、课程内容,供大家免费下载体验。

751

2023.08.11

c++空格相关教程合集
c++空格相关教程合集

本专题整合了c++空格相关教程,阅读专题下面的文章了解更多详细内容。

0

2026.01.23

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
Excel 教程
Excel 教程

共162课时 | 13.1万人学习

成为PHP架构师-自制PHP框架
成为PHP架构师-自制PHP框架

共28课时 | 2.4万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号