吴泳铭:Qwen团队正进行RSI探索,计划训练5
吴泳铭:Qwen团队正进行RSI探索,计划训练5-10T参数模型
吴泳铭:Qwen团队正进行RSI探索,计划训练5-10T参数模型
2026年09月22日 10:48
新浪科技讯 9月22日上午消息,今日举办的2026云栖大会上,阿里巴巴集团首席执行官吴泳铭分享指出:“未来AI模型将扩展至5-10T参数规模”。
吴泳铭指出,过去一年,通往ASI的技术路径逐渐清晰。这条路径被称为递归式自我改进(RSI),模型从真实反馈中发现自身短板,自己设计实验、构建数据、评价结果,循环推动自身进化。目前,Qwen团队正在进行RSI方面的探索,并取得一定进展。Qwen还在持续推进模型架构和数据优化研究,计划训练5—10T参数规模的全新模型,目标是完成更复杂、更长程的任务,向ASI迈进。
一颗聪明的大脑还不够。吴泳铭认为,AI还需要掌握感知和交互能力,像人一样理解声音、图像、表情和动作,对齐人类的文化、审美和价值观。因此,理解与生成一体化的多模态模型成为阿里的另一个重要研究方向。当AI能像人一样交流,人们就不必再面对复杂的交互界面。
智能也在走向终端。在桌面端,开源的Qwen27B模型可以流畅运行,支持开发者和企业本地化部署。在移动端,阿里发布了Qwen Intelligence,为合作伙伴提供AI解决方案,让手机能完成各类复杂任务。
他还进一步指出,阿里平头哥已对数据中心芯片进行全面布局,包括真武系列GPU、倚天系列CPU、磐脉系列智能网卡,以及ICN互联芯片。组建超大规模AI集群所需的核心芯片已全面覆盖。
本届云栖大会上,阿里平头哥发布国产AI芯片真武V900,算力提升至真武M890的3倍。基于它构建的单一集群可扩展至50万卡,可支撑前沿模型的训练和推理。阿里表示,由于平头哥芯片产品线的成熟和客户的广泛应用,预计年出货量将大幅提升。
据悉,阿里正在对芯片、服务器、超节点、网络、模型和推理系统进行联合调优,提升整个AI集群的Token产能和效率。自研的M890 AI超节点已支撑超过2万亿参数大模型的高效推理,并在阿里云上实现规模化供给。今年第四季度,阿里云还将新增服务节点,进一步扩大超节点的供给规模。