登录

动作


分类

模型

在不久前落幕的“2026世界机器人大会(WRC)”上,银河通用创始人王鹤提到一组对比数据:2025年,银河通用发布世界动作模型论文时,他能找到的相关论文只有他们一篇;
文章

过去几年,具身大脑的主流答案是VLA(视觉—语言—动作模型),把视觉、语言和动作放进同一个端到端模型,让机器人从人类示范中学习下一步动作
文章

标注

光象科技将训练过程分成了几个阶段,互联网视频和没有动作标注的人类第一视角数据,主要用于建立模型对物理世界的基础认识;
文章

带有动作标注的第一视角数据,帮助模型学习动作发生后物体状态如何变化;
文章