0

0

阿里云通义开源长文本模型及推理框架,百万Tokens处理速度提升近7倍

花韻仙語

花韻仙語

发布时间:2025-01-27 20:42:01

|

420人浏览过

|

来源于php中文网

原创

阿里云重磅开源qwen2.5-1m大模型,支持百万tokens上下文!该模型提供7b和14b两种尺寸,在处理长文本任务中显著超越gpt-4o-mini。阿里云还同步开源了推理框架,大幅提升了长文本处理速度。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

阿里云通义开源长文本模型及推理框架,百万Tokens处理速度提升近7倍

百万Tokens上下文能力意味着模型能够处理相当于10部长篇小说、150小时演讲稿或3万行代码的文本量。继两个月前Qwen2.5-Turbo升级百万Tokens上下文后,此次开源进一步降低了开发者和企业的使用门槛。 开发者可以利用Qwen2.5-1M进行长篇小说分析、学术论文解析,甚至探索仓库级代码的分析和优化。

阿里云通义开源长文本模型及推理框架,百万Tokens处理速度提升近7倍

在“大海捞针”等长文本理解基准测试中,Qwen2.5-1M展现出卓越性能,甚至在部分测试中超越了GPT-4o-mini。 阿里云团队通过创新性的长度外推技术和Dual Chunk Attention机制,高效地将模型上下文长度扩展至百万级别,同时有效控制了成本。

阿里云通义开源长文本模型及推理框架,百万Tokens处理速度提升近7倍

为了优化推理速度,阿里云团队在vLLM推理引擎基础上,引入了基于Minference的稀疏注意力机制等多项改进,将处理百万级别长文本输入的预填充速度提升了3.2倍到6.7倍。

Qwen2.5-1M模型及其推理框架已在魔搭社区ModelScope、HuggingFace和GitHub上开源,方便开发者下载和使用。 开发者和企业也可以通过阿里云百炼平台调用Qwen2.5-Turbo模型API,或通过Qwen Chat平台体验模型性能。

Bardeen AI
Bardeen AI

使用AI自动执行人工任务

下载

相关链接:

演示Demo:https://www.php.cn/link/a49ffb16c3666d2f693bc7b5fdca969d

Modelscope:https://www.php.cn/link/d9e7aeae02fade22d8a268303051be75

Huggingface:https://www.php.cn/link/1d4bf338b9f623355c3dfc9f20aa2b53

开源框架地址:https://www.php.cn/link/b1d4b6452378d64ccbfe7f20fca7843c

Qwen Chat体验:https://www.php.cn/link/4c2d760f60a6ea70b0a10ef9ff2351f5

相关专题

更多
github中文官网入口 github中文版官网网页进入
github中文官网入口 github中文版官网网页进入

github中文官网入口https://docs.github.com/zh/get-started,GitHub 是一种基于云的平台,可在其中存储、共享并与他人一起编写代码。 通过将代码存储在GitHub 上的“存储库”中,你可以: “展示或共享”你的工作。 持续“跟踪和管理”对代码的更改。

456

2026.01.21

http与https有哪些区别
http与https有哪些区别

http与https的区别:1、协议安全性;2、连接方式;3、证书管理;4、连接状态;5、端口号;6、资源消耗;7、兼容性。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

2060

2024.08.16

c++ 根号
c++ 根号

本专题整合了c++根号相关教程,阅读专题下面的文章了解更多详细内容。

57

2026.01.23

c++空格相关教程合集
c++空格相关教程合集

本专题整合了c++空格相关教程,阅读专题下面的文章了解更多详细内容。

57

2026.01.23

yy漫画官方登录入口地址合集
yy漫画官方登录入口地址合集

本专题整合了yy漫画入口相关合集,阅读专题下面的文章了解更多详细内容。

236

2026.01.23

漫蛙最新入口地址汇总2026
漫蛙最新入口地址汇总2026

本专题整合了漫蛙最新入口地址大全,阅读专题下面的文章了解更多详细内容。

393

2026.01.23

C++ 高级模板编程与元编程
C++ 高级模板编程与元编程

本专题深入讲解 C++ 中的高级模板编程与元编程技术,涵盖模板特化、SFINAE、模板递归、类型萃取、编译时常量与计算、C++17 的折叠表达式与变长模板参数等。通过多个实际示例,帮助开发者掌握 如何利用 C++ 模板机制编写高效、可扩展的通用代码,并提升代码的灵活性与性能。

17

2026.01.23

php远程文件教程合集
php远程文件教程合集

本专题整合了php远程文件相关教程,阅读专题下面的文章了解更多详细内容。

103

2026.01.22

PHP后端开发相关内容汇总
PHP后端开发相关内容汇总

本专题整合了PHP后端开发相关内容,阅读专题下面的文章了解更多详细内容。

73

2026.01.22

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号