登录

动作


分类

选择

一条用于推理阶段的当次动作选择,另一条用于训练阶段的长期策略更新。
文章

这种方式仅改变本次动作选择,但不会更新参数。
文章

二者结合后较基础策略共提高10个百分点,说明在这两项任务中,更新策略产生的作用更明显,而规划可以在此基础上进一步改善当次动作选择。
文章

生成

因此Motus2采用动作优先(Action-first)的信息流,让动作只读取此前信息,未来视频读取动作,价值评估再读取动作和预测结果,以保证动作生成过程符合真实部署时的因果顺序。
文章

它用共享模型连接动作生成、后果预测和价值评估,从约13万小时人类第一视角视频中提取操作先验,再用机器人轨迹完成本体适配。
文章

此前,生数科技发布的Motus已在统一潜在动作世界模型中连接视频预测和动作生成。
文章

模型

视觉语言动作模型(VLA)可以根据画面和指令输出动作,世界模型则尝试预测动作执行后环境将如何变化。
文章

它既可作为世界动作模型(WAM),根据语言指令、当前观测和视觉历史生成动作,也可作为动作条件世界模型(AC-WM),在给定动作后预测未来视觉状态,分别回答“下一步做什么”和“执行后会发生什么”。
文章

近年来,模仿学习和视觉语言动作模型从示范数据中学习“观测—动作”映射,提高了任务泛化能力。
文章

学习

例如,经过筛选的成功示范可以直接监督动作学习;
文章