0

0

元象首个多模态大模型XVERSE-V开源,刷新权威大模型榜单,支持任意宽高比输入

WBOY

WBOY

发布时间:2024-04-28 16:43:08

|

887人浏览过

|

来源于机器之心

转载

人类获取的信息83%来自视觉,图文多模态大模型能感知更丰富和精确的真实世界信息,构建更全面的认知智能,从而向agi(通用人工智能)迈出更大步伐。

元象今日发布多模态大模型 XVERSE-V,支持任意宽高比图像输入,在主流评测中效果领先。 该模型全开源,无条件免费商用 ,持续推动海量中小企业、研究者和开发者的研发和应用创新。 

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

元象首个多模态大模型XVERSE-V开源,刷新权威大模型榜单,支持任意宽高比输入XVERSE-V性能优异,在多项权威多模态评测中超过零一万物Yi-VL-34B、面壁智能OmniLMM-12B及深度求索DeepSeek-VL-7B等开源模型,在综合能力测评MMBench中超过了谷歌GeminiProVision、阿里Qwen-VL-Plus和Claude-3V Sonnet等知名闭源模型。元象首个多模态大模型XVERSE-V开源,刷新权威大模型榜单,支持任意宽高比输入图. 多模态大模型综合评测

融合整体和局部的高清图像表示

传统的多模态模型的图像表示只有整体,XVERSE-V  创新性地采用了融合整体和局部的策略,支持输入任意宽高比的图像。兼顾全局的概览信息和局部的细节信息,能够识别和分析图像中的细微特征,看的更清楚,理解的更准确。元象首个多模态大模型XVERSE-V开源,刷新权威大模型榜单,支持任意宽高比输入元象首个多模态大模型XVERSE-V开源,刷新权威大模型榜单,支持任意宽高比输入                              注:Concate* 表示按列进行拼接

这样的处理方式使模型可以应用于广泛的领域,包括全景图识别、卫星图像、古文物扫描分析等。

示例- 高清全景图识别 、图片细节文字识别元象首个多模态大模型XVERSE-V开源,刷新权威大模型榜单,支持任意宽高比输入元象首个多模态大模型XVERSE-V开源,刷新权威大模型榜单,支持任意宽高比输入

免费下载大模型

•Hugging Face:https://huggingface.co/xverse/XVERSE-V-13B

•ModelScope魔搭:https://modelscope.cn/models/xverse/XVERSE-V-13B

•Github:https://github.com/xverse-ai/XVERSE-V-13B

•问询发送:opensource@xverse.cn

元象持续打造国内开源标杆,在 国内最早开源最大参数65B 全球最早开源最长上下文256K 以及 国际前沿的MoE模型 , 并在 SuperCLUE测评全国领跑 。此次推出MoE模型, 填补 国产开源空白,更将其 推向了国际领先水 平。

商业应用上,元象大模型是 广东最早获得国家备案的模型之一 ,可向全社会提供服务。元象大模型去年起已和多个腾讯产品,包括 QQ音乐 、虎牙直播、全民K歌、腾讯云等,进行深度合作与应用探索,为文化、娱乐、旅游、金融领域打造创新领先的用户体验。 元象首个多模态大模型XVERSE-V开源,刷新权威大模型榜单,支持任意宽高比输入

多方向实际应用表现突出

模型不仅在基础能力上表现出色,在实际的应用场景中也有着出色的表现。具备不同场景下的理解能力,能够处理信息图、文献、现实场景、数理题目、科学文献、代码转化等不同需求。

图表理解

ListenHub
ListenHub

超真实的AI播客生成器

下载

不论是复杂图文结合的信息图理解,还是单一图表的分析与计算,模型都能够自如应对。元象首个多模态大模型XVERSE-V开源,刷新权威大模型榜单,支持任意宽高比输入元象首个多模态大模型XVERSE-V开源,刷新权威大模型榜单,支持任意宽高比输入

视障真实场景

在真实视障场景测试集VizWiz中,XVERSE-V表现出色,超过了InternVL-Chat-V1.5、DeepSeek-VL-7B 等几乎所有主流的开源多模态大模型。该测试集包含了来自真实视障用户提出的超过31,000个视觉问答,能准确反映用户的真实需求与琐碎细小的问题,帮助视障人群克服他们日常真实的视觉挑战。元象首个多模态大模型XVERSE-V开源,刷新权威大模型榜单,支持任意宽高比输入

                           VizWiz测试示例

看图内容创作

XVERSE-V具备多模态能力的同时保持强大的文本生成能力,能够很好胜任理解图像后创造性文本生成的任务。元象首个多模态大模型XVERSE-V开源,刷新权威大模型榜单,支持任意宽高比输入

教育解题

模型具备了广泛的知识储备和逻辑推理能力,能够识别图像解答不同学科的问题。元象首个多模态大模型XVERSE-V开源,刷新权威大模型榜单,支持任意宽高比输入

百科解答

模型储备了历史、文化、科技、安全等各类主题的知识。元象首个多模态大模型XVERSE-V开源,刷新权威大模型榜单,支持任意宽高比输入

代码撰写元象首个多模态大模型XVERSE-V开源,刷新权威大模型榜单,支持任意宽高比输入

自动驾驶元象首个多模态大模型XVERSE-V开源,刷新权威大模型榜单,支持任意宽高比输入

情感理解与识别元象首个多模态大模型XVERSE-V开源,刷新权威大模型榜单,支持任意宽高比输入

相关专题

更多
人工智能在生活中的应用
人工智能在生活中的应用

人工智能在生活中的应用有语音助手、无人驾驶、金融服务、医疗诊断、智能家居、智能推荐、自然语言处理和游戏设计等。本专题为大家提供人工智能相关的文章、下载、课程内容,供大家免费下载体验。

411

2023.08.17

人工智能的基本概念是什么
人工智能的基本概念是什么

人工智能的英文缩写为AI,是研究、开发用于模拟、延伸和扩展人的智能的理论、方法、技术及应用系统的一门新的技术科学;该领域的研究包括机器人、语言识别、图像识别、自然语言处理和专家系统等。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

302

2024.01.09

人工智能不能取代人类的原因是什么
人工智能不能取代人类的原因是什么

人工智能不能取代人类的原因包括情感与意识、创造力与想象力、伦理与道德、社会交往与沟通能力、灵活性与适应性、持续学习和自我提升等。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

628

2024.09.10

Python 人工智能
Python 人工智能

本专题聚焦 Python 在人工智能与机器学习领域的核心应用,系统讲解数据预处理、特征工程、监督与无监督学习、模型训练与评估、超参数调优等关键知识。通过实战案例(如房价预测、图像分类、文本情感分析),帮助学习者全面掌握 Python 机器学习模型的构建与实战能力。

33

2025.10.21

http与https有哪些区别
http与https有哪些区别

http与https的区别:1、协议安全性;2、连接方式;3、证书管理;4、连接状态;5、端口号;6、资源消耗;7、兼容性。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

1984

2024.08.16

高德地图升级方法汇总
高德地图升级方法汇总

本专题整合了高德地图升级相关教程,阅读专题下面的文章了解更多详细内容。

44

2026.01.16

全民K歌得高分教程大全
全民K歌得高分教程大全

本专题整合了全民K歌得高分技巧汇总,阅读专题下面的文章了解更多详细内容。

89

2026.01.16

C++ 单元测试与代码质量保障
C++ 单元测试与代码质量保障

本专题系统讲解 C++ 在单元测试与代码质量保障方面的实战方法,包括测试驱动开发理念、Google Test/Google Mock 的使用、测试用例设计、边界条件验证、持续集成中的自动化测试流程,以及常见代码质量问题的发现与修复。通过工程化示例,帮助开发者建立 可测试、可维护、高质量的 C++ 项目体系。

25

2026.01.16

java数据库连接教程大全
java数据库连接教程大全

本专题整合了java数据库连接相关教程,阅读专题下面的文章了解更多详细内容。

36

2026.01.15

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号