0

0

Python深度学习训练动作识别模型的视频预处理步骤说明【指导】

冷炫風刃

冷炫風刃

发布时间:2025-12-18 21:45:08

|

307人浏览过

|

来源于php中文网

原创

视频预处理需四步:时间对齐(统一时长后均匀抽帧)、空间归一化(短边缩放+中心裁剪)、轻量增强(禁用旋转/尺度变换)、光流补充(tv-l1算法生成双通道);最终存为hdf5/lmdb格式并校验完整性。

python深度学习训练动作识别模型的视频预处理步骤说明【指导】

训练动作识别模型前,视频预处理直接影响模型能否学到有效时序和空间特征。关键不是“把视频变小”,而是保留动作关键帧、统一时空结构、适配网络输入要求。

抽帧与时间对齐

动作识别依赖帧间变化,不能简单等间隔采样。需根据视频时长和模型帧数要求做动态调整:

  • 先统一视频时长:用插值或裁剪将所有视频缩放到固定秒数(如3秒),避免长短不一导致batch无法堆叠
  • 再按目标帧数(如32帧)均匀采样:若原视频有96帧,取第0、3、6…93帧;不足则循环补帧或镜像填充
  • 推荐用decord库读帧,比OpenCV快且支持GPU解码;避免用imageio或moviepy,易内存溢出

空间归一化与增强

动作发生在人体局部区域,但模型看到的是整帧图像。需在不失真前提下聚焦主体、抑制干扰:

  • 中心裁剪+短边缩放:先将视频帧短边缩放到256,再中心裁剪224×224(适配ResNet等主干)
  • 轻量级增强仅限训练阶段:随机水平翻转(对称动作慎用)、亮度/对比度±15%扰动、每帧加少量高斯噪声(σ=0.01)
  • 不做尺度缩放或旋转增强——动作方向性敏感(如“挥手向左”≠“向右”),会破坏语义

光流或运动线索补充(可选)

RGB帧隐含运动信息弱,尤其慢速动作。可额外生成双通道光流图作为第二输入模态:

Nimo.space
Nimo.space

智能画布式AI工作台

下载

立即学习Python免费学习笔记(深入)”;

  • TV-L1算法计算相邻帧光流(比Farneback更鲁棒),输出u/v两通道,归一化到[-1,1]
  • 与RGB帧分开预处理:光流不做色彩增强,但需同样裁剪+缩放,并堆叠为(T, 2, H, W)张量
  • 若用Two-Stream网络,RGB流和光流流需分别送入两个分支,最后融合logits而非特征图

组织为高效数据格式

频繁IO是训练瓶颈。避免实时解码视频文件,应提前固化为内存友好的格式:

  • 训练集转为HDF5LMDB:每个样本存为(T, C, H, W)数组,带标签字段;支持多进程随机读取
  • 验证/测试集可保留原始视频路径+帧索引列表(JSON),按需加载,节省存储
  • 务必校验:抽帧后检查首尾帧是否完整、光流方向是否一致、标签索引是否越界

基本上就这些。预处理不复杂但容易忽略细节——比如没做时间对齐导致batch内帧数不一致,PyTorch DataLoader直接报错;或者光流未归一化,梯度爆炸。稳住这四步,模型才能真正学动作,而不是学背景或压缩伪影。

热门AI工具

更多
DeepSeek
DeepSeek

幻方量化公司旗下的开源大模型平台

豆包大模型
豆包大模型

字节跳动自主研发的一系列大型语言模型

通义千问
通义千问

阿里巴巴推出的全能AI助手

腾讯元宝
腾讯元宝

腾讯混元平台推出的AI助手

文心一言
文心一言

文心一言是百度开发的AI聊天机器人,通过对话可以生成各种形式的内容。

讯飞写作
讯飞写作

基于讯飞星火大模型的AI写作工具,可以快速生成新闻稿件、品宣文案、工作总结、心得体会等各种文文稿

即梦AI
即梦AI

一站式AI创作平台,免费AI图片和视频生成。

ChatGPT
ChatGPT

最最强大的AI聊天机器人程序,ChatGPT不单是聊天机器人,还能进行撰写邮件、视频脚本、文案、翻译、代码等任务。

相关专题

更多
json数据格式
json数据格式

JSON是一种轻量级的数据交换格式。本专题为大家带来json数据格式相关文章,帮助大家解决问题。

442

2023.08.07

json是什么
json是什么

JSON是一种轻量级的数据交换格式,具有简洁、易读、跨平台和语言的特点,JSON数据是通过键值对的方式进行组织,其中键是字符串,值可以是字符串、数值、布尔值、数组、对象或者null,在Web开发、数据交换和配置文件等方面得到广泛应用。本专题为大家提供json相关的文章、下载、课程内容,供大家免费下载体验。

544

2023.08.23

jquery怎么操作json
jquery怎么操作json

操作的方法有:1、“$.parseJSON(jsonString)”2、“$.getJSON(url, data, success)”;3、“$.each(obj, callback)”;4、“$.ajax()”。更多jquery怎么操作json的详细内容,可以访问本专题下面的文章。

322

2023.10.13

go语言处理json数据方法
go语言处理json数据方法

本专题整合了go语言中处理json数据方法,阅读专题下面的文章了解更多详细内容。

81

2025.09.10

堆和栈的区别
堆和栈的区别

堆和栈的区别:1、内存分配方式不同;2、大小不同;3、数据访问方式不同;4、数据的生命周期。本专题为大家提供堆和栈的区别的相关的文章、下载、课程内容,供大家免费下载体验。

419

2023.07.18

堆和栈区别
堆和栈区别

堆(Heap)和栈(Stack)是计算机中两种常见的内存分配机制。它们在内存管理的方式、分配方式以及使用场景上有很大的区别。本文将详细介绍堆和栈的特点、区别以及各自的使用场景。php中文网给大家带来了相关的教程以及文章欢迎大家前来学习阅读。

594

2023.08.10

页面置换算法
页面置换算法

页面置换算法是操作系统中用来决定在内存中哪些页面应该被换出以便为新的页面提供空间的算法。本专题为大家提供页面置换算法的相关文章,大家可以免费体验。

455

2023.08.14

pytorch是干嘛的
pytorch是干嘛的

pytorch是一个基于python的深度学习框架,提供以下主要功能:动态图计算,提供灵活性。强大的张量操作,实现高效处理。自动微分,简化梯度计算。预构建的神经网络模块,简化模型构建。各种优化器,用于性能优化。想了解更多pytorch的相关内容,可以阅读本专题下面的文章。

445

2024.05.29

pixiv网页版官网登录与阅读指南_pixiv官网直达入口与在线访问方法
pixiv网页版官网登录与阅读指南_pixiv官网直达入口与在线访问方法

本专题系统整理pixiv网页版官网入口及登录访问方式,涵盖官网登录页面直达路径、在线阅读入口及快速进入方法说明,帮助用户高效找到pixiv官方网站,实现便捷、安全的网页端浏览与账号登录体验。

462

2026.02.13

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
最新Python教程 从入门到精通
最新Python教程 从入门到精通

共4课时 | 22.4万人学习

Django 教程
Django 教程

共28课时 | 4.4万人学习

SciPy 教程
SciPy 教程

共10课时 | 1.6万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号