登录

动作


分类

轨迹

前者保留真实视觉信息,后者方便在推理时自由输入新的动作轨迹。
文章

状态

直接接收原始动作状态的Ctrl-World,在双臂机器人上也容易生成静止或损坏的画面。
文章

执行

实验中先由DiffusionPolicy为同一场景采样多条候选动作后,视频模型生成对应未来,Gemini3.1Pro再从任务进度、物理真实性和接触情况等方面评价每段视频,最后选择最优动作执行。
文章

产生

预测机器人动作产生的环境变化;
文章

之间

可问题在于,对视觉模型来说,要建立某组数字和画面动作之间的对应关系,需要额外的学习。
文章