Python神经网络教程_前向传播与反向传播

冷炫風刃

发布时间：2026-01-08 13:53:26

567人浏览过

来源于php中文网

原创

前向传播是输入数据经加权求和、加偏置、激活函数逐层变换得到输出的过程，不更新参数；反向传播利用链式法则从损失函数梯度出发，逐层计算权重与偏置的梯度并更新。

python神经网络教程_前向传播与反向传播

前向传播：数据怎么“流过”神经网络

前向传播是神经网络做预测的过程：输入数据从输入层开始，逐层经过加权求和、加偏置、激活函数变换，最终得到输出。比如一个两层网络（含1个隐藏层），计算过程是：

隐藏层输出 = 激活函数(输入 × 权重₁ + 偏置₁)
输出层输出 = 激活函数(隐藏层输出 × 权重₂ + 偏置₂)

常用激活函数如ReLU（max(0, x)）或Sigmoid（1 / (1 + exp(-x))），它们让网络能拟合非线性关系。注意：前向传播不更新参数，只产生预测值和中间结果——这些中间结果在反向传播时会被复用。

反向传播：误差怎么“流回来”更新参数

反向传播的本质是链式法则的工程实现：从损失函数对输出的梯度出发，逐层往回计算损失对每个权重和偏置的偏导数。核心步骤是：

计算输出层误差项（如：预测值与真实标签的差 × 输出层激活函数导数）
用该误差项乘以前一层输出，得到对当前层权重的梯度
用误差项乘以1，得到对当前层偏置的梯度
将误差项传递到前一层（乘以上一层权重转置，再乘该层激活函数导数）

例如，用均方误差（MSE）和Sigmoid激活时，输出层误差项 = (y_pred − y_true) × y_pred × (1 − y_pred)；ReLU的导数在x>0时为1，在x≤0时为0，实际编码中常写成 (x > 0).astype(float)。

立即学习“Python免费学习笔记（深入）”；

手动实现一小段前向+反向代码（无框架）

理解原理最直接的方式是手写一个单隐藏层网络的关键片段：

# 前向
z1 = X @ W1 + b1    # 隐藏层加权和
a1 = np.maximum(0, z1)  # ReLU
z2 = a1 @ W2 + b2   # 输出层加权和
y_pred = 1 / (1 + np.exp(-z2))  # Sigmoid输出
<h1>反向（假设MSE损失）</h1><p>d_loss_dz2 = (y_pred - y_true) <em> y_pred </em> (1 - y_pred)  # 输出层误差项
d_loss_dW2 = a1.T @ d_loss_dz2
d_loss_db2 = np.sum(d_loss_dz2, axis=0)</p><p>d_loss_da1 = d_loss_dz2 @ W2.T
d_loss_dz1 = d_loss_da1 * (z1 > 0)  # ReLU导数
d_loss_dW1 = X.T @ d_loss_dz1
d_loss_db1 = np.sum(d_loss_dz1, axis=0)</p><h1>更新权重（SGD）</h1><p>W1 -= lr <em> d_loss_dW1
b1 -= lr </em> d_loss_db1
W2 -= lr <em> d_loss_dW2
b2 -= lr </em> d_loss_db2

为什么容易卡在反向传播？几个关键提醒

初学反向传播常因细节出错导致梯度为0或爆炸。注意：

矩阵维度必须对齐：W1.shape = (input_dim, hidden_dim)，X.shape = (batch_size, input_dim)，所以 X @ W1 合理；反向时 d_loss_dW1 = X.T @ d_loss_dz1，形状才匹配
激活函数导数不能漏：Sigmoid导数不是“1−y”，而是“y×(1−y)”；ReLU导数不是常数1，需按输入值分段
批量训练时，对偏置的梯度要沿 batch 维度求和（np.sum(..., axis=0)），否则形状错
初始化权重不能全零：会导致所有神经元学习相同特征，梯度对称失效；推荐用小随机数，如 np.random.randn(...) * 0.01

Python 装饰器实现原理及面试回答模板

为什么 macOS 上同时存在多个 Python 版本？

Python函数注解实践_类型提示落地方案

Python异步任务取消机制_async任务取消解析

为什么 macOS 上会同时存在多个 Python 版本？

相关标签:

python 编码神经网络 red batch Float

本站声明：本文内容由网友自发贡献，版权归原作者所有，本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容，请联系admin@php.cn

上一篇：Python转AI工程师教程_技能结构全解析下一篇：如何在单元测试中捕获被测函数内部创建的 DataFrame 实例

作者最新文章

苹果手机ID账号在哪里查的

2026-03-02 00:59

手机上怎么弄JPG照片手机图片转换为JPG格式方法

2026-03-02 03:25

苹果手机相机用不了怎么办相机无法使用解决方案

2026-03-02 05:23

苹果手机相机专业模式专业模式拍照功能介绍

2026-03-02 05:45

荣耀手机关闭后台应用荣耀手机清理最近使用应用技巧

2026-03-02 06:37

苹果手机照片变jpg格式苹果手机照片转换为JPG方法

2026-03-02 08:05

Linux 虚拟机快照管理与恢复

2026-03-02 08:40

IQOO怎么5G切换4G网络 IQOO网络模式切换教程

2026-03-02 09:05

苹果手机相机怎么调最清晰拍照清晰度优化设置

2026-03-02 09:15

GitHub 代码怎么复现？项目复现流程与注意事项

2026-03-02 10:43

热门AI工具

DeepSeek

幻方量化公司旗下的开源大模型平台

AI编程开发 AI聊天问答

豆包大模型

字节跳动自主研发的一系列大型语言模型

AI编程开发 AI大模型

通义千问

阿里巴巴推出的全能AI助手

AI编程开发 Agent智能体

腾讯元宝

腾讯混元平台推出的AI助手

文档处理 Excel 表格

文心一言

文心一言是百度开发的AI聊天机器人，通过对话可以生成各种形式的内容。

AI编程开发 AI文本写作

讯飞写作

基于讯飞星火大模型的AI写作工具，可以快速生成新闻稿件、品宣文案、工作总结、心得体会等各种文文稿

AI文本写作中文写作

即梦AI

一站式AI创作平台，免费AI图片和视频生成。

图片拼接图画生成

ChatGPT

最最强大的AI聊天机器人程序，ChatGPT不单是聊天机器人，还能进行撰写邮件、视频脚本、文案、翻译、代码等任务。

AI编程开发 AI文本写作

智谱清言 - 免费全能的AI助手

AI编程开发 Agent智能体

相关专题

css中float用法

css中float属性允许元素脱离文档流并沿其父元素边缘排列，用于创建并排列、对齐文本图像、浮动菜单边栏和重叠元素。想了解更多float的相关内容，可以阅读本专题下面的文章。

593

2024.04.28

C++中int、float和double的区别

本专题整合了c++中int和double的区别，阅读专题下面的文章了解更多详细内容。

105

2025.10.23

PHP高性能API设计与Laravel服务架构实践

本专题围绕 PHP 在现代 Web 后端开发中的高性能实践展开，重点讲解基于 Laravel 框架构建可扩展 API 服务的核心方法。内容涵盖路由与中间件机制、服务容器与依赖注入、接口版本管理、缓存策略设计以及队列异步处理方案。同时结合高并发场景，深入分析性能瓶颈定位与优化思路，帮助开发者构建稳定、高效、易维护的 PHP 后端服务体系。

2026.03.04

AI安装教程大全

2026最全AI工具安装教程专题：包含各版本AI绘图、AI视频、智能办公软件的本地化部署手册。全篇零基础友好，附带最新模型下载地址、一键安装脚本及常见报错修复方案。每日更新，收藏这一篇就够了，让AI安装不再报错！

2026.03.04

Swift iOS架构设计与MVVM模式实战

本专题聚焦 Swift 在 iOS 应用架构设计中的实践，系统讲解 MVVM 模式的核心思想、数据绑定机制、模块拆分策略以及组件化开发方法。内容涵盖网络层封装、状态管理、依赖注入与性能优化技巧。通过完整项目案例，帮助开发者构建结构清晰、可维护性强的 iOS 应用架构体系。

2026.03.03

C++高性能网络编程与Reactor模型实践

本专题围绕 C++ 在高性能网络服务开发中的应用展开，深入讲解 Socket 编程、多路复用机制、Reactor 模型设计原理以及线程池协作策略。内容涵盖 epoll 实现机制、内存管理优化、连接管理策略与高并发场景下的性能调优方法。通过构建高并发网络服务器实战案例，帮助开发者掌握 C++ 在底层系统与网络通信领域的核心技术。

2026.03.03

Golang 测试体系与代码质量保障：工程级可靠性建设

Go语言测试体系与代码质量保障聚焦于构建工程级可靠性系统。本专题深入解析Go的测试工具链（如go test）、单元测试、集成测试及端到端测试实践，结合代码覆盖率分析、静态代码扫描（如go vet）和动态分析工具，建立全链路质量监控机制。通过自动化测试框架、持续集成（CI）流水线配置及代码审查规范，实现测试用例管理、缺陷追踪与质量门禁控制，确保代码健壮性与可维护性，为高可靠性工程系统提供质量保障。

2026.02.28

Golang 工程化架构设计：可维护与可演进系统构建

Go语言工程化架构设计专注于构建高可维护性、可演进的企业级系统。本专题深入探讨Go项目的目录结构设计、模块划分、依赖管理等核心架构原则，涵盖微服务架构、领域驱动设计(DDD)在Go中的实践应用。通过实战案例解析接口抽象、错误处理、配置管理、日志监控等关键工程化技术，帮助开发者掌握构建稳定、可扩展Go应用的最佳实践方法。

2026.02.28

Golang 性能分析与运行时机制：构建高性能程序

Go语言以其高效的并发模型和优异的性能表现广泛应用于高并发、高性能场景。其运行时机制包括 Goroutine 调度、内存管理、垃圾回收等方面，深入理解这些机制有助于编写更高效稳定的程序。本专题将系统讲解 Golang 的性能分析工具使用、常见性能瓶颈定位及优化策略，并结合实际案例剖析 Go 程序的运行时行为，帮助开发者掌握构建高性能应用的关键技能。

2026.02.28

热门下载

网站特效

网站源码

网站素材

前端模板