如何批量生成每列仅含一个1的二进制DataFrame集合（Python教程）

霞舞

发布时间：2026-01-31 12:14:25

574人浏览过

来源于php中文网

原创

如何批量生成每列仅含一个1的二进制DataFrame集合（Python教程）

本文介绍如何使用numpy和pandas高效批量生成多个4×4二进制dataframe，每个dataframe每列恰好有一个1（其余为0），并通过循环或列表推导式统一管理。

在数据分析与模拟实验中，常需构造结构化随机二进制矩阵——例如用于表示独热编码（one-hot）状态、资源分配掩码或神经网络初始连接模式。核心要求是：每个列有且仅有一个1，其余为0，且各矩阵彼此独立、随机生成。

原始代码中使用 bin1_df == bin1_df.max() 存在逻辑缺陷：DataFrame.max() 默认按列计算最大值，返回一个Series，而直接比较会导致广播行为不稳定，且无法保证每列唯一最大值（若存在并列最大值，将产生多个1）。更鲁棒的做法是：对每列独立采样一个行索引作为1的位置。

推荐采用现代NumPy随机数生成器（default_rng），它比旧式 np.random.rand 更安全、可复现，并支持向量化操作：

import pandas as pd
import numpy as np

from numpy.random import default_rng

rng = default_rng(seed=42)  # 可选：设seed确保结果可复现

# 批量生成4个4×4二进制DataFrame，每列仅一个1
n_matrices = 4
shape = (4, 4)
bins = []

for _ in range(n_matrices):
    # 步骤1：为每列随机选择一个行索引（0~3）
    hot_rows = rng.integers(0, shape[0], size=shape[1])  # shape[1] = 4列 → 得到4个索引

    # 步骤2：初始化全零矩阵
    mat = np.zeros(shape, dtype=int)

    # 步骤3：按列设置对应行的值为1（利用高级索引）
    mat[hot_rows, np.arange(shape[1])] = 1

    # 步骤4：转为DataFrame并加入集合
    bins.append(pd.DataFrame(mat))

✅ 输出示例（前两个）：

立即学习“Python免费学习笔记（深入）”；

uBrand

一站式AI品牌创建平台，在线品牌设计，AI品牌策划，智能品牌营销；uBrand帮助创业者轻松打造个性品牌！

下载

   0  1  2  3
0  0  0  1  0
1  1  0  0  0
2  0  0  0  1
3  0  1  0  0

   0  1  2  3
0  0  1  0  0
1  0  0  0  1
2  1  0  1  0
3  0  0  0  0

? 关键优势说明：

✅ 确定性约束：每列严格只有一个1，无并列风险；
✅ 高性能：避免逐元素比较，全程向量化；
✅ 可扩展：轻松修改 n_matrices 和 shape 参数适配不同规模；
✅ 可复现：通过 seed 参数控制随机性；
✅ 内存友好：直接构建整数矩阵，无需浮点中间步骤。

⚠️ 注意事项：

避免使用 vars()[name] = ... 动态创建变量名——这违反Python最佳实践，难以调试且易引发命名冲突；应始终使用列表或字典存储多个对象；
若需后续按名称访问（如 bins['matrix_2']），可用字典推导式：
```
bins_dict = {f'bin_{i+1}': df for i, df in enumerate(bins)}
```

总结：用 rng.integers 为每列指定“激活行”，再通过NumPy高级索引批量赋值，是生成此类结构化二进制矩阵最清晰、高效且可维护的方式。

Python 动态与静态类型的平衡策略

Python 中的条件嵌套：正确缩进实现多分支游戏逻辑

如何用循环批量生成二值化 DataFrame 集合（每列仅一个 1）

如何用循环批量生成二值化 DataFrame 集合（每列仅含一个 1）

Python 使用 Cython 提升性能的思路

相关标签:

python 编码 app 神经网络 numpy pandas 循环对象数据分析

本站声明：本文内容由网友自发贡献，版权归原作者所有，本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容，请联系admin@php.cn

上一篇：Amadeus API 点位搜索中 page[limit] 参数的正确用法详解下一篇：暂无

作者最新文章

如何在 Go 中从 Redis 列表类型键安全获取所有元素

2026-01-29 15:45

Remix Logic 现已推出DLSS 加速 Half Sword、Highguard、《噬血代码 II》(CODE VEIN II) ARC Raiders：Headwinds 更新

2026-01-29 15:45

Minecraft源码中IN_FIRE与ON_FIRE伤害源的区别解析

2026-01-29 16:04

iPhone 18 Pro能直连星链：苹果史上首次

2026-01-29 16:16

如何在 ES6 中遍历对象内部的多个数组

2026-01-29 16:26

如何在多个 C 模块中复用 Go 导出的回调函数

2026-01-29 16:49

皓衣行原著小说叫什么

2026-01-29 16:49

Tone.js 序列进度与状态监控完整指南

2026-01-29 17:15

目标地图怎么开会员-目标地图会员开通方法

2026-01-29 17:38

任天堂邀请多位记者赴纽约大型直面会或将揭晓

2026-01-29 17:40

热门AI工具

DeepSeek

幻方量化公司旗下的开源大模型平台

AI 编程开发 AI 聊天问答

豆包大模型

字节跳动自主研发的一系列大型语言模型

AI 编程开发 AI大模型

通义千问

阿里巴巴推出的全能AI助手

AI 编程开发 Agent智能体

腾讯元宝

腾讯混元平台推出的AI助手

文档处理 AI 聊天问答

文心一言

文心一言是百度开发的AI聊天机器人，通过对话可以生成各种形式的内容。

AI 编程开发 AI 文本写作

讯飞写作

基于讯飞星火大模型的AI写作工具，可以快速生成新闻稿件、品宣文案、工作总结、心得体会等各种文文稿

AI 文本写作中文写作

即梦AI

一站式AI创作平台，免费AI图片和视频生成。

图片拼接

ChatGPT

最最强大的AI聊天机器人程序，ChatGPT不单是聊天机器人，还能进行撰写邮件、视频脚本、文案、翻译、代码等任务。

AI 编程开发 AI 文本写作

智谱清言 - 免费全能的AI助手

AI 编程开发 Agent智能体

相关专题

Python 时间序列分析与预测

本专题专注讲解 Python 在时间序列数据处理与预测建模中的实战技巧，涵盖时间索引处理、周期性与趋势分解、平稳性检测、ARIMA/SARIMA 模型构建、预测误差评估，以及基于实际业务场景的时间序列项目实操，帮助学习者掌握从数据预处理到模型预测的完整时序分析能力。

2025.12.04

Python 数据清洗与预处理实战

本专题系统讲解 Python 在数据清洗与预处理中的核心技术，包括使用 Pandas 进行缺失值处理、异常值检测、数据格式化、特征工程与数据转换，结合 NumPy 高效处理大规模数据。通过实战案例，帮助学习者掌握如何处理混乱、不完整数据，为后续数据分析与机器学习模型训练打下坚实基础。

2026.01.31

数据分析的方法

数据分析的方法有：对比分析法，分组分析法，预测分析法，漏斗分析法，AB测试分析法，象限分析法，公式拆解法，可行域分析法，二八分析法，假设性分析法。php中文网为大家带来了数据分析的相关知识、以及相关文章等内容。

474

2023.07.04

数据分析方法有哪几种

数据分析方法有：1、描述性统计分析；2、探索性数据分析；3、假设检验；4、回归分析；5、聚类分析。本专题为大家提供数据分析方法的相关的文章、下载、课程内容，供大家免费下载体验。

280

2023.08.07

网站建设功能有哪些

网站建设功能包括信息发布、内容管理、用户管理、搜索引擎优化、网站安全、数据分析、网站推广、响应式设计、社交媒体整合和电子商务等功能。这些功能可以帮助网站管理员创建一个具有吸引力、可用性和商业价值的网站，实现网站的目标。

739

2023.10.16

数据分析网站推荐

数据分析网站推荐：1、商业数据分析论坛；2、人大经济论坛-计量经济学与统计区；3、中国统计论坛；4、数据挖掘学习交流论坛；5、数据分析论坛；6、网站数据分析；7、数据分析；8、数据挖掘研究院；9、S-PLUS、R统计论坛。想了解更多数据分析的相关内容，可以阅读本专题下面的文章。

516

2024.03.13

Python 数据分析处理

本专题聚焦 Python 在数据分析领域的应用，系统讲解 Pandas、NumPy 的数据清洗、处理、分析与统计方法，并结合数据可视化、销售分析、科研数据处理等实战案例，帮助学员掌握使用 Python 高效进行数据分析与决策支持的核心技能。

2025.09.08

Python 数据分析与可视化

本专题聚焦 Python 在数据分析与可视化领域的核心应用，系统讲解数据清洗、数据统计、Pandas 数据操作、NumPy 数组处理、Matplotlib 与 Seaborn 可视化技巧等内容。通过实战案例（如销售数据分析、用户行为可视化、趋势图与热力图绘制），帮助学习者掌握从原始数据到可视化报告的完整分析能力。

2025.10.14