
基于 2026 云栖大会主论坛演讲《Qwen迈向真实世界智能体》· 演讲人阿里巴巴 ATH 事业群 Token Foundry Qwen LLM 项目负责人 刘大一恒 · 视频源Bilibili BV1p3hE6iEgW核心论断大模型的使用方式正在发生不可逆的范式跃迁从“单轮对话应答”彻底转向“真实世界独立完成任务”。作为通义千问新任负责人刘大一恒首次公开阐述了 Qwen 从问答底座迈向超级智能ASI的完整路线图——以持续 Scaling 为基石以 RSI递归自我改进为进化飞轮全面攻入企业级生产与全模态具身环境。01 Qwen 掌门人首秀30亿下载背后的开源繁荣作为川大博士、原华为“天才少年”第一档、阿里达摩院早期核心成员刘大一恒长期统领 Qwen 的预训练工作。在此次云栖大会上他正式以 Token Foundry Qwen LLM 项目负责人的身份登台代表通义大模型交出了成绩单开源生态规模通义千问Qwen全系列开源模型在全球 Hugging Face 及魔搭社区的累计下载量已突破30 亿次衍生模型数量超过30 万个持续稳居全球开源生态领军地位。从模型到智能体Agent用户对模型的诉求已经不再满足于聊天和写文案而是要求它深入代码工程、科研实验、复杂业务系统等真实生产环境成为能够自主规划、调用 API、并发排查错误的“数字员工”。02 Qwen 迈向超级智能的四大演进维度在 15 分钟的演讲中刘大一恒系统拆解了通义千问迈向真实世界智能体的四大核心技术抓手深入真实生产加速 RSI 进化摆脱传统海量人工标注的瓶颈推动模型在真实场景交互中实现递归式自我改进零人工介入下自主纠错迭代。革新模型架构突破效率边界从纯稠密架构向更高效的稀疏 MoE 架构跃迁重构注意力机制与状态管理降低单任务运行的显存与计算开销。迈向全模态拓宽 Agent 边界融合图像、视频、音频与物理世界空间信息使智能体具备多模态理解与物理世界常识胜任具身操作。持续 Scaling突破智能上限Scaling Law 远未见顶。模型参数向万亿、十万亿级演进通过更高质量数据与算力协同探索智能天花板。03 核心技术底牌RSI递归式自我改进究竟怎么跑通刘大一恒重点披露了 Qwen 研发团队在 RSI 领域的突破性进展。传统的强化学习高度依赖人类设计的 Reward Model 或人工打标数据边际效益递减且极易遭遇泛化瓶颈。Qwen3.8-Max 及后续架构正在探索全新的自主闭环自主实验设计模型能够针对自身在推理、代码、复杂规划上的薄弱环节主动构建合成实验测试集。自我纠错与验证依托确定性环境编译器运行结果、数学逻辑证明、API 返回状态码充当客观评估器模型在试错中自我打分并更新策略。零人工干预进化人类研究员的角色从“直接喂数据/写 Prompt”转变为“定义物理与逻辑的边界环境”模型自身完成大部分日常迭代在国际多项大模型基准评测中实现了持续跃升。04 产品规划与未来路线图透底在演讲后半段刘大一恒首次公开了 Qwen 系列模型的下一步产品发布节奏Qwen4 系列即将推出包括面向超复杂任务推理的旗舰版Qwen4-Max主打极致性价比与高并发吞吐的Qwen4-Flash Qwen4-Plus以及专为端侧和私有化部署深度优化的Qwen4-27B开源主力版本。远期预研并进团队已同步启动了 Qwen 4.5 与下一代面向十万亿参数范式的 Qwen 5 系列架构探索全力押注通往人工超级智能ASI的技术主线。工程师视角的技术落地启示演进方向落地价值需要警惕的误区RSI 自我改进优先在代码生成、单元测试验证、数据库 SQL 调优等有明确编译/运行结果的场景落地在缺乏客观环境反馈的开放文案/主观判断场景盲目追求“自主进化”MoE 稀疏架构单 Token 推理成本显著下降吞吐量成倍提升适合高并发 Agent 编排通信开销增加需要配合更强的高速片间互联与网络调度支持全模态 Agent打通视觉、语音与操作界面的统一感知实现跨 GUI/物理世界的多模态闭环多模态幻觉叠加需加强长视频与时空定位的一致性校验来源2026 云栖大会主论坛演讲《Qwen迈向真实世界智能体》主讲人刘大一恒。内容经技术整理与工程化拆解仅供技术讨论与学习参考。