0

0

大规模模型的发展受到限制,需要创建可解释的人工智能理论

王林

王林

发布时间:2024-01-16 22:00:14

|

1498人浏览过

|

来源于搜狐

转载

gpt-4的局限在于仅能与数字世界互动,而我们最终需要与物理世界互动。为此,机器人的出现尤为重要,它代表着具身智能的实现。张钹指出,并非必须开发人形机器人,也不需要过于复杂的硬件。他主张以一定的硬件为基础进行强化学习研究。这样的方法可以在不改变原有意义的情况下进行微调。

全世界对大模型的强大能力和潜力感到惊讶,但无法解释其原因,只能将其归结为“涌现”现象。为了人工智能产业的健康发展,必须综合科学研究、技术创新和产业发展。要发展第三代人工智能,必须建立可解释和鲁棒的理论和方法,否则AI技术将永远难以令人信服。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

张钹院士:大模型存在难以逾越的天花板,必须建立可解释AI理论

大语言模型存在天花板。

虽然通向通用人工智能的道路依然艰难,但大语言模型为AI产业开辟了一条宽广的道路。在智谱AI 2024年度技术开放日上,张钹院士表示,大模型为发展通用硬件和软件提供了机会。

传统AI范式利用特定的算法和规则完成特定任务,生成式AI范式是基于一种称为基础模型的通用模型,通过广泛文本数据的训练,在开领域(open domain,开域)内可以生成类似于人类水平的高质量文本、图像和其他内容,通过微调等方式可适配于广泛的下游任务。生成式AI向通用AI迈出一步,第二步是AI智能体,第三步则是具身智能。张钹表示,GPT-4只能和数字世界打交道,我们最终必须跟物理世界打交道,这就需要机器人,也就是具身智能。具身智能的提出有助于构造完整的智能体,让智能体既有感知,又有思考。“不一定要做人形机器人,因为很多时候只要用手或脚就可以了,不需要把硬件搞得非常复杂。”他主张以一定的硬件为基础进行强化学习研究。

AIBox 一站式AI创作平台
AIBox 一站式AI创作平台

AIBox365一站式AI创作平台,支持ChatGPT、GPT4、Claue3、Gemini、Midjourney等国内外大模型

下载

生成式AI大模型具备三大能力和一大缺点。首先是强大的生成能力,它能够根据上下文和过去的对话生成多样性的连贯文本,让人们感到惊讶。其次是强大的迁移能力,即通过代理任务的训练和细调适配,能够应用到感兴趣的下游任务中。第三是强大的交互能力,包括人机交互、多智能体之间的交互以及与环境的交互,使得AI能够在各个领域展现出与人类相媲美的智能水平。然而,这些大模型也存在一个缺点,即幻觉。有时候,它们会生成看似合理的编造或无意义的答案。

人工智能有助于推动经济增长,建筑、维护、安装等行业难以被自动化和智能化,但行政管理等白领工作或被AI替代。AI可提高大多数人类工作的质量和效率,但被AI完全替代的工作仍是少数。之所以AI还不能替代大多数工作,是因为大模型还存在难以逾越的天花板。张钹表示,大模型的所有工作都是外部提示而非主动,并且在外部提示的情况下利用概率预测完成任务,而人类的工作依靠内部意图驱动。大语言模型生成语言与人类语言生成只是行为上的相似性,而内在机制根本不同,大语言模型存在不自知、质量不可控、不可信、不鲁棒等天花板,给出不同的提示词,大模型会输出不同的回答。大模型也会产生幻觉,“不管模型多么大,幻觉这个缺点一直存在。”

他提出,要发展第三代人工智能,必须建立可解释和鲁棒的人工智能理论和方法,发展安全、可控、可信、可靠、可扩展的AI技术,推动AI的创新应用和产业化。如果不能建立可解释和鲁棒的人工智能理论,AI技术是不可靠的,AI技术永远难以令人相信。“到现在为止,这个理论还没有建立起来,这也是人工智能之所以发展缓慢和曲折的原因。理论建立不起来,是因为受到三个特定限制,过去只能在特定领域利用特定模型解决特定任务,这怎么可能建立通用理论?大模型的出现为建立这个理论提供了可能性。”

张钹表示,大模型为我们提供了发展通用硬件和软件的机会。人工智能正进入稳步发展的阶段,对各行各业有巨大影响,必须抓住机遇发展人工智能产业。但仍有大量不确定性,因为AI不可预测、不可控。全世界对大模型强大的生成能力、迁移能力、交互能力感到惊讶,却无法解释,只能归结为“涌现”。所以为了人工智能产业的健康发展,必须将科学研究、技术创新、产业发展结合起来。

热门AI工具

更多
DeepSeek
DeepSeek

幻方量化公司旗下的开源大模型平台

豆包大模型
豆包大模型

字节跳动自主研发的一系列大型语言模型

WorkBuddy
WorkBuddy

腾讯云推出的AI原生桌面智能体工作台

腾讯元宝
腾讯元宝

腾讯混元平台推出的AI助手

文心一言
文心一言

文心一言是百度开发的AI聊天机器人,通过对话可以生成各种形式的内容。

讯飞写作
讯飞写作

基于讯飞星火大模型的AI写作工具,可以快速生成新闻稿件、品宣文案、工作总结、心得体会等各种文文稿

即梦AI
即梦AI

一站式AI创作平台,免费AI图片和视频生成。

ChatGPT
ChatGPT

最最强大的AI聊天机器人程序,ChatGPT不单是聊天机器人,还能进行撰写邮件、视频脚本、文案、翻译、代码等任务。

相关专题

更多
页面置换算法
页面置换算法

页面置换算法是操作系统中用来决定在内存中哪些页面应该被换出以便为新的页面提供空间的算法。本专题为大家提供页面置换算法的相关文章,大家可以免费体验。

500

2023.08.14

PHP 命令行脚本与自动化任务开发
PHP 命令行脚本与自动化任务开发

本专题系统讲解 PHP 在命令行环境(CLI)下的开发与应用,内容涵盖 PHP CLI 基础、参数解析、文件与目录操作、日志输出、异常处理,以及与 Linux 定时任务(Cron)的结合使用。通过实战示例,帮助开发者掌握使用 PHP 构建 自动化脚本、批处理工具与后台任务程序 的能力。

67

2025.12.13

TypeScript类型系统进阶与大型前端项目实践
TypeScript类型系统进阶与大型前端项目实践

本专题围绕 TypeScript 在大型前端项目中的应用展开,深入讲解类型系统设计与工程化开发方法。内容包括泛型与高级类型、类型推断机制、声明文件编写、模块化结构设计以及代码规范管理。通过真实项目案例分析,帮助开发者构建类型安全、结构清晰、易维护的前端工程体系,提高团队协作效率与代码质量。

25

2026.03.13

Python异步编程与Asyncio高并发应用实践
Python异步编程与Asyncio高并发应用实践

本专题围绕 Python 异步编程模型展开,深入讲解 Asyncio 框架的核心原理与应用实践。内容包括事件循环机制、协程任务调度、异步 IO 处理以及并发任务管理策略。通过构建高并发网络请求与异步数据处理案例,帮助开发者掌握 Python 在高并发场景中的高效开发方法,并提升系统资源利用率与整体运行性能。

44

2026.03.12

C# ASP.NET Core微服务架构与API网关实践
C# ASP.NET Core微服务架构与API网关实践

本专题围绕 C# 在现代后端架构中的微服务实践展开,系统讲解基于 ASP.NET Core 构建可扩展服务体系的核心方法。内容涵盖服务拆分策略、RESTful API 设计、服务间通信、API 网关统一入口管理以及服务治理机制。通过真实项目案例,帮助开发者掌握构建高可用微服务系统的关键技术,提高系统的可扩展性与维护效率。

177

2026.03.11

Go高并发任务调度与Goroutine池化实践
Go高并发任务调度与Goroutine池化实践

本专题围绕 Go 语言在高并发任务处理场景中的实践展开,系统讲解 Goroutine 调度模型、Channel 通信机制以及并发控制策略。内容包括任务队列设计、Goroutine 池化管理、资源限制控制以及并发任务的性能优化方法。通过实际案例演示,帮助开发者构建稳定高效的 Go 并发任务处理系统,提高系统在高负载环境下的处理能力与稳定性。

50

2026.03.10

Kotlin Android模块化架构与组件化开发实践
Kotlin Android模块化架构与组件化开发实践

本专题围绕 Kotlin 在 Android 应用开发中的架构实践展开,重点讲解模块化设计与组件化开发的实现思路。内容包括项目模块拆分策略、公共组件封装、依赖管理优化、路由通信机制以及大型项目的工程化管理方法。通过真实项目案例分析,帮助开发者构建结构清晰、易扩展且维护成本低的 Android 应用架构体系,提升团队协作效率与项目迭代速度。

92

2026.03.09

JavaScript浏览器渲染机制与前端性能优化实践
JavaScript浏览器渲染机制与前端性能优化实践

本专题围绕 JavaScript 在浏览器中的执行与渲染机制展开,系统讲解 DOM 构建、CSSOM 解析、重排与重绘原理,以及关键渲染路径优化方法。内容涵盖事件循环机制、异步任务调度、资源加载优化、代码拆分与懒加载等性能优化策略。通过真实前端项目案例,帮助开发者理解浏览器底层工作原理,并掌握提升网页加载速度与交互体验的实用技巧。

102

2026.03.06

Rust内存安全机制与所有权模型深度实践
Rust内存安全机制与所有权模型深度实践

本专题围绕 Rust 语言核心特性展开,深入讲解所有权机制、借用规则、生命周期管理以及智能指针等关键概念。通过系统级开发案例,分析内存安全保障原理与零成本抽象优势,并结合并发场景讲解 Send 与 Sync 特性实现机制。帮助开发者真正理解 Rust 的设计哲学,掌握在高性能与安全性并重场景中的工程实践能力。

227

2026.03.05

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号