0

0

Video Depth Anything来了!字节开源首款10分钟级长视频深度估计模型,性能SOTA

DDD

DDD

发布时间:2025-01-27 20:44:01

|

1144人浏览过

|

来源于php中文网

原创

字节跳动联合团队开源video depth anything (vda),实现高效稳定的长视频深度估计

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

图片

AIxiv专栏持续报道全球顶尖AI实验室的最新研究成果。 字节跳动智能创作AR团队和豆包大模型团队近日联合发布了Video Depth Anything (VDA) 项目,该项目有效解决了单目深度估计模型在视频领域面临的时间一致性难题。VDA基于Depth Anything V2,通过融合高效时空注意力机制、精简时域一致性损失函数以及创新的关键帧长视频推理策略,实现了对长达10分钟视频的精准、稳定、高效的深度估计。

VDA的优势:速度与精度兼顾

单目深度估计模型广泛应用于增强现实、3D重建和自动驾驶等领域。Depth Anything系列模型因其泛化能力强、细节丰富、计算效率高而备受关注。然而,其在视频应用中容易受画面剧烈变化和运动模糊影响,导致精度和稳定性下降。

立即进入豆包AI人工智官网入口”;

立即学习豆包AI人工智能在线问答入口”;

VDA巧妙地解决了这一问题。它沿用Depth Anything V2作为编码器,并新增轻量级时空头,在不牺牲原有模型特征的前提下,有效融合时间维度信息。同时,VDA提出了一种新颖的时序梯度匹配损失函数,无需依赖光流信息,即可实现时序一致性约束。 此外,VDA的关键帧推理策略,能够高效处理超长视频,并最大限度地减少计算负担和累积误差。

图片

实验结果:SOTA表现

Mootion
Mootion

Mootion是一个革命性的3D动画创作平台,利用AI技术来简化和加速3D动画的制作过程。

下载

在六个基准数据集上的实验结果表明,VDA在精度、稳定性和速度方面均超越了现有SOTA模型,精度提升超过10个百分点,速度更是此前最高精度模型的10倍以上。在V100显卡上,小型VDA模型的推理速度甚至可达30FPS。

图片

图片图片

项目信息:

Prompt Depth Anything:另一项开源成果

除了VDA,豆包大模型团队还与浙江大学合作开源了Prompt Depth Anything,实现了4K分辨率下的高精度绝对深度估计。该技术通过引入提示机制,利用LiDAR数据等作为提示信息,显著提升了深度估计的精度。 这项技术也具有广泛的下游应用潜力,例如3D重建、自动驾驶和机器人抓取等。

图片图片图片图片图片图片

相关文章

数码产品性能查询
数码产品性能查询

该软件包括了市面上所有手机CPU,手机跑分情况,电脑CPU,电脑产品信息等等,方便需要大家查阅数码产品最新情况,了解产品特性,能够进行对比选择最具性价比的商品。

下载

本站声明:本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn

相关专题

更多
github中文官网入口 github中文版官网网页进入
github中文官网入口 github中文版官网网页进入

github中文官网入口https://docs.github.com/zh/get-started,GitHub 是一种基于云的平台,可在其中存储、共享并与他人一起编写代码。 通过将代码存储在GitHub 上的“存储库”中,你可以: “展示或共享”你的工作。 持续“跟踪和管理”对代码的更改。

422

2026.01.21

http与https有哪些区别
http与https有哪些区别

http与https的区别:1、协议安全性;2、连接方式;3、证书管理;4、连接状态;5、端口号;6、资源消耗;7、兼容性。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

2059

2024.08.16

c++ 根号
c++ 根号

本专题整合了c++根号相关教程,阅读专题下面的文章了解更多详细内容。

17

2026.01.23

c++空格相关教程合集
c++空格相关教程合集

本专题整合了c++空格相关教程,阅读专题下面的文章了解更多详细内容。

22

2026.01.23

yy漫画官方登录入口地址合集
yy漫画官方登录入口地址合集

本专题整合了yy漫画入口相关合集,阅读专题下面的文章了解更多详细内容。

91

2026.01.23

漫蛙最新入口地址汇总2026
漫蛙最新入口地址汇总2026

本专题整合了漫蛙最新入口地址大全,阅读专题下面的文章了解更多详细内容。

124

2026.01.23

C++ 高级模板编程与元编程
C++ 高级模板编程与元编程

本专题深入讲解 C++ 中的高级模板编程与元编程技术,涵盖模板特化、SFINAE、模板递归、类型萃取、编译时常量与计算、C++17 的折叠表达式与变长模板参数等。通过多个实际示例,帮助开发者掌握 如何利用 C++ 模板机制编写高效、可扩展的通用代码,并提升代码的灵活性与性能。

14

2026.01.23

php远程文件教程合集
php远程文件教程合集

本专题整合了php远程文件相关教程,阅读专题下面的文章了解更多详细内容。

65

2026.01.22

PHP后端开发相关内容汇总
PHP后端开发相关内容汇总

本专题整合了PHP后端开发相关内容,阅读专题下面的文章了解更多详细内容。

59

2026.01.22

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号