登录

世界模型迎来「中国引领时刻」,昆仑万维Matrix-Game 3.5要迈向真实世界


速读:昆仑万维董事长兼CEO方汉在论坛上进一步宣布:“2026年为世界模型元年。
2026年07月23日 12:0

世界模型牌桌上,昆仑万维已连出五张牌,一张比一张大。

    作者丨幸丽娟

    编辑丨齐铖湧

世界模型的热度,终究还是烧到了今年的 WAIC。

整场大会,论坛、展台、发布会,世界模型几乎成了“灵魂”一般的存在。

因为具身落地元年—— AI 要迈向现实世界,世界模型必不可少。

不同于资本场中,创业公司频频用 零产品、零营收 撬动百亿估值,大家在 WAIC 上追问的是更朴素也更直白的技术问题:世界模型如何真正理解物理世界? 如何走向真实世界?

7月19日,昆仑万维举办的“ 世界模型与多模态范式革命”专场论坛 ,用硬核的技术细节,回应了这些问题。

昆仑万维董事长兼 CEO 方汉在论坛上进一步宣布:“2026年为 世界模型元年。 ”

昆仑万维董事长兼CEO方汉 昆仑万维董事长兼CEO方汉 而  Matrix-Game 3.5 ,便是昆仑万维在这个“元年”里,打 出的一张王牌。

01

“物体恒存”这道基础题,到底怎么解?

查看 Matrix-Game 3.5  发布的技术突破细节,会发现“物理恒存”是被单独拎出来重点攻克的问题。

为什么?

因为这道物理世界最基础的题,曾让世界模型集体翻了车。

翻车这事,要从一个评测基准说起。

哈佛、MIT、IBM、谷歌联合发布的一个评测基准,叫做 MemoBench,考的是“物体恒存”——东西离开视野再回来,还在不在?长什么样?位置变没变?

三岁孩童都能拿满分, 十个主流世界模型集体不及格——满分 1 分,最高分 0.58 分。

原因藏在 Matrix-Game 团队曾对世界模型给出的定义框架中——理解当下状态、预测下一个状态、将预测结果渲染呈现。

而大多数模型只做到了第三层。“物体恒存”测试不及格, 便是它们跳过了前两层,直接“渲染”所付出的代价。

MemoBench 给的“评语”也很直白:现有模型即使能生成视觉上完全连贯的画面,也几乎无法在物体重新出现时,正确恢复它在消失期间本该经历的状态变化。

“物体恒存”问题,可以拆成三道更具体的题:

记不住:无法维持对物体身份的持续表征。

认不出:无法在物体重现时准确识别其身份。

变不对:无法正确推演并还原物体在消失期间发生的状态变化。

Matrix-Game 3.5 一道一道,给解了出来。

▎ “记不住”?Matrix-Game 3.5 :把“时间相册”升级为“三维地图”。

模型为什么会“记不住”?

这源自于 Transformer的结构性缺陷:注意力窗口越大,早期信息被稀释得越严重。记住了新的,旧的就被挤出。

即便行业标杆谷歌 Genie 3,也只能保持约一分钟的一致性,之后场景逐渐崩坏。

问题出在记忆方式上。模型记的是“第5帧左上角有个方块”——时间索引。人类记的是“沙发在客厅角落”——空间索引。

时间索引随序列线性增长,记忆容量爆炸。空间索引只随场景复杂度增长,与时长无关。

Matrix-Game 3.5 实现业内首个几何对齐的 Patch 级长期记忆,把记忆从时间索引切换为空间 索引,将历史观察提升至三维Patch Memory。

主题:世界模型|昆仑万维|Matrix-Game3.5|发布