世界模型迎来「中国引领时刻」,昆仑万维Matrix-Game 3.5要迈向真实世界
世界模型牌桌上,昆仑万维已连出五张牌,一张比一张大。
作者丨幸丽娟
编辑丨齐铖湧
世界模型的热度,终究还是烧到了今年的 WAIC。
整场大会,论坛、展台、发布会,世界模型几乎成了“灵魂”一般的存在。
因为具身落地元年—— AI 要迈向现实世界,世界模型必不可少。
不同于资本场中,创业公司频频用 零产品、零营收 撬动百亿估值,大家在 WAIC 上追问的是更朴素也更直白的技术问题:世界模型如何真正理解物理世界? 如何走向真实世界?
7月19日,昆仑万维举办的“ 世界模型与多模态范式革命”专场论坛 ,用硬核的技术细节,回应了这些问题。
昆仑万维董事长兼 CEO 方汉在论坛上进一步宣布:“2026年为 世界模型元年。 ”
昆仑万维董事长兼CEO方汉 而 Matrix-Game 3.5 ,便是昆仑万维在这个“元年”里,打 出的一张王牌。
01
“物体恒存”这道基础题,到底怎么解?
查看 Matrix-Game 3.5 发布的技术突破细节,会发现“物理恒存”是被单独拎出来重点攻克的问题。
为什么?
因为这道物理世界最基础的题,曾让世界模型集体翻了车。
翻车这事,要从一个评测基准说起。
哈佛、MIT、IBM、谷歌联合发布的一个评测基准,叫做 MemoBench,考的是“物体恒存”——东西离开视野再回来,还在不在?长什么样?位置变没变?
三岁孩童都能拿满分, 十个主流世界模型集体不及格——满分 1 分,最高分 0.58 分。
原因藏在 Matrix-Game 团队曾对世界模型给出的定义框架中——理解当下状态、预测下一个状态、将预测结果渲染呈现。
而大多数模型只做到了第三层。“物体恒存”测试不及格, 便是它们跳过了前两层,直接“渲染”所付出的代价。
MemoBench 给的“评语”也很直白:现有模型即使能生成视觉上完全连贯的画面,也几乎无法在物体重新出现时,正确恢复它在消失期间本该经历的状态变化。
“物体恒存”问题,可以拆成三道更具体的题:
记不住:无法维持对物体身份的持续表征。
认不出:无法在物体重现时准确识别其身份。
变不对:无法正确推演并还原物体在消失期间发生的状态变化。
Matrix-Game 3.5 一道一道,给解了出来。
▎ “记不住”?Matrix-Game 3.5 :把“时间相册”升级为“三维地图”。
模型为什么会“记不住”?
这源自于 Transformer的结构性缺陷:注意力窗口越大,早期信息被稀释得越严重。记住了新的,旧的就被挤出。
即便行业标杆谷歌 Genie 3,也只能保持约一分钟的一致性,之后场景逐渐崩坏。
问题出在记忆方式上。模型记的是“第5帧左上角有个方块”——时间索引。人类记的是“沙发在客厅角落”——空间索引。
时间索引随序列线性增长,记忆容量爆炸。空间索引只随场景复杂度增长,与时长无关。
Matrix-Game 3.5 实现业内首个几何对齐的 Patch 级长期记忆,把记忆从时间索引切换为空间 索引,将历史观察提升至三维Patch Memory。
主题:世界模型|昆仑万维|Matrix-Game3.5|发布