尽管概念和技术仍未收敛但世界模型热潮涌动
尽管概念和技术仍未收敛 但世界模型热潮涌动
2026年08月06日 20:48
“跟几家VC聊,5—6月说完全不看‘世界模型’,7月就官宣投了‘世界模型’。”进入8月,美团原联合创始人、现投资人王慧文发文称:“AI的叙事真是按月变啊,跟不上节奏。”于是就有了开头这句感慨。
在7月中旬举行的世界 人工智能 大会(WAIC 2026)上,多家厂商集体定调2026年为“世界模型元年”,资本热度也快速攀升。根据IT桔子的数据,世界模型赛道在2024年仅有10家新公司成立,2025年翻倍至20家,而2026年仅前7个月成立的新公司就已超去年全年总量,截至8月初已达到23家。
记者了解到,世界模型并不是新鲜词,它已活跃在学术论文和自动驾驶的仿真器里很多年。2026年,世界模型开始热起来,只不过处于未收敛的状态。
“2026年是世界模型元年,资本极度追捧,但行业仍处于概念未收敛、技术路线未收敛、数据标准未收敛的早期阶段,大部分工作停留在视觉生成层面,距离真正的物理世界理解尚有距离。”国内第一家布局世界模型公司北京极佳视界科技有限公司(以下简称“极佳视界”)联合创始人兼首席科学家朱政对记者表示。
技术路线尚未收敛
在一场具身 机器人 专题技术研讨会上,“人形 机器人 第一股” 优必选 科技(09880.HK)高级副总裁、战略投资总顾问侯宗放表示,市场对于人形 机器人 的需求量远超行业能提供的量,但“主要问题就是行业的基模都还没有产生”。
这个基座模型长什么样?目前,世界模型和VLA(Vision-Language-Action,视觉—语言—动作)模型是具身智能与物理AI的核心技术焦点,而以WAM(World Action Model,世界动作模型)为代表的世界模型,成为继VLA之后的技术风向标。
“ 机器人 是世界模型进入物理世界最直接的载体,因此目前关于世界模型的讨论主要集中在具身智能、 人形机器人 和基础模型企业。”北京辉羲智能科技有限公司(以下简称“辉羲智能”)创始人兼CEO徐宁仪表示,世界模型围绕具身 机器人 环境理解、自主行动及具身智能落地展开。
据了解,辉羲智能成立于2022年4月,定位于具身智能大小脑计算平台供应商,聚焦具身 机器人 端侧计算与量产部署,今年2月完成超8亿元的Pre-B融资,其中包括智元机器人等多家具身智能领军企业和产业CVC共同参与。而创始人徐宁仪本硕博均毕业于清华,此前是 微软 亚洲研究院硬件计算组负责人、 百度 芯片部门主任架构师。
徐宁仪还指出,从当前世界模型行业参与主体看,既包括世界模型和基础模型团队、机器人本体企业,在包括芯片、计算平台、数据、仿真和评测机构。
具体而言,朱政表示,当前国内乃至世界模型的主要参与者,在国际上包括OpenAI、谷歌DeepMind、Yann LeCun领导的AMI Labs、李飞飞的World Labs以及 英伟达 等;国内方面,据不完全统计已有33家创业公司入局,同时字节、腾讯、华为等大厂也已布局。
记者从多名采访对象处得到这样一个共识,那就是世界模型目前的技术路线高度分化,尚未收敛,甚至连各流派的名字都未统一。
朱政把现有的技术路线分为三类:一是像素生成派,以极佳视界为代表,直接在像素空间生成视觉画面;二是隐空间表征派,以无界动力为代表,在潜在空间做抽象表征预测;三是融合派,以大晓机器人、蚂蚁灵波、自变量机器人、智元机器人等为代表,尝试将理解、生成、预测一体化。
而徐宁仪的分类是这样的:一是隐空间预测,学习世界状态及其变化;二是生成式时空建模,通过视频、3D或4D状态生成进行推演与仿真;三是动作条件驱动,将世界模型与VLA、Agentic System结合,形成从感知、预测到决策和行动的闭环。
在大晓机器人看来,这些技术流派可分为表征式、生成式、交互式和理解生成预测一体化。
“当前全球具身智能产业加速演进,世界模型沿表征式、生成式、交互式等技术路线持续迭代,却始终面临‘能力强、落地难’的共性困境。”大晓机器人方面表示。
据悉,大晓机器人由商汤科技联合创始人王晓刚和 京东 探索研究院前院长陶大程于2025年12月共同创立,是一家专注具身智能和物理AI的初创企业。
短期落地难
根据IT桔子的数据,截至8月初,今年已成立的23家世界模型公司中有18家在成立后数月内就完成了首轮或前两轮融资,其中2家在 种子 轮或Pre-A轮就被标记为 独角兽 ,4家进入估值10亿元以上俱乐部。
比如,8月3日,破壳机器人宣布完成亿美元级Pre-A轮融资,成为本赛道最新的千里马项目;7月31日,菜鸟前CTO李强创办的 昆腾 动力完成超亿元 种子 轮;7月24日,深圳的伊辛智脑完成数千万元 种子 轮。
而在世界模型的投资阵容方面,红杉中国、高瓴 创投 、腾讯投资、蚂蚁集团、经纬 创投 、创新工场、顺为资本等一线机构密集出手,小米战投、智元机器人、乐聚机器人、星海图等产业方也以战略投资者身份入场。显然,中国世界模型创业的第一波格局已初步形成。
然而,当前世界模型的多数方案仍停留在虚拟场景与实验室演示阶段,长时序推演误差放大、真实物理数据稀缺等核心瓶颈未获实质突破,规模化商用落地案例少。
朱政表示,世界模型短期落地的障碍主要有四个方面:“第一是数据困境,互联网视频数据与机器人所需的物理交互数据存在本质差异,数据类型错配,且真实物理世界数据规模严重不足;第二是物理一致性问题,现有模型多为数据驱动的视觉模型,难以将物理规律准确嵌入,长程推演容易出现物理退化;第三是算力与成本,高保真世界模型的训练和推理对算力需求极高;第四是场景泛化,在家庭等开放环境中,模型尚缺乏足够通用和可泛化的能力。”
面对世界模型“能力强、落地难”的共性困境,大晓机器人开源了原生行动一体化开悟世界模型 3.1(Kairos 3.1),并首次提出具身世界模型的第一性原理——世界模型的核心价值,在于从冗余的多模态输入中提炼高密度关键信息,锚定控制充分状态,在不确定的真实环境中最小化机器人智能体的行动代价。其底层逻辑可概括为:机器人掌握的关键信息越丰富,对控制充分状态的判断就越精准,最终执行任务时的行动代价就越低。
作为具身智能芯片与计算平台供应商,辉羲智能是如何考虑“世界模型需要什么样的硬件平台”的问题?
徐宁仪表示,世界模型需要的不是一颗单纯追求更高TOPS的芯片,而是一套能够承接算法演进的系统级计算平台。
“首先,要具备足够的计算、存储和数据吞吐能力,持续处理多模态 传感器 数据和时空状态;其次,要具备高带宽、低时延和实时性,支撑机器人从感知、预测到决策和行动的闭环;最后,要具备较强的通用性和可编程性,通过编译器和工具链持续适配尚未收敛的模型、算子与任务。”他同时指出,这个计算平台还要支持机器人“大脑”与“小脑”的协同计算,并满足功耗、可靠性、整机集成和量产部署要求。
据他介绍,辉羲智能的光至R1芯片可提供500 TOPS AI算力,并集成24颗Arm Cortex-A78AE CPU核心,能同时承载多模态感知、模型推理、任务决策和实时控制等不同负载;其自研RPU计算内核具备较强的可编程能力,可以适应世界模型和VLA持续变化的算子与计算模式;配合RISE计算平台及软件工具链,则能够进一步支持模型迁移、算子开发、性能优化和具身机器人整机部署。
“因此,衡量世界模型硬件不能只看峰值算力,还要 综合 考察计算、存储、 通信 、实时性、可编程性和工程化能力。辉羲希望提供的也不只是一颗芯片,而是一套贯穿模型适配、整机集成和量产交付全过程的具身智能计算平台。”徐宁仪指出。
(文章来源:中国经营报)