登录

视频


分类

模型

一家做图像生成的公司跑来卷机器人控制,说明视频模型里积累的「物理直觉」正被越来越多的团队当作机器人大脑的底座。
文章

OpenWAM从阿里开源的视频模型Wan2.2-5B出发,先在约334万条机器人与人类交互视频上继续预训练,名义时长约1.46万小时,全程不用动作标签,在32块B200上训练了14天。
文章