阿里千问开源Qwen-Drive-1.0-4 B:首个面向自动驾驶的视觉语言基础模型
IT之家 9 月 6 日消息,阿里千问本周开源了 Qwen-Drive-1.0-4B,这是一款基于 Qwen3.5-4B 构建的自动驾驶视觉语言模型。
官方表示,Qwen-Drive-1.0 是 首个面向自动驾驶的视觉语言基础模型 ,在预训练阶段统一了 3D 感知与视觉问答,并进一步扩展至运动规划,同时完全保留了预训练 VLM 的原始架构。
模型采用分阶段训练方案,将驾驶监督与通用视觉语言数据结合,在获得驾驶特定能力的同时,保留通用视觉理解与指令遵循能力。Qwen-Drive-1.0-4B 同时提供 SFT 和 RL 两个规划专家,官方评测覆盖 3D 感知、驾驶场景理解、通用视觉语言能力,以及开环、伪闭环和闭环运动规划。
据介绍,Qwen-Drive-1.0 仅使用公开来源构建规划样本 ,统一了各数据集的轨迹格式,并从开环预测到闭环驾驶进行全面评估。SFT 模型在所有基准上已具备竞争力。经过强化学习后,该模型仅以微小的开环位移误差为代价,换来了在人类偏好对齐和闭环安全性方面的全面提升。




新浪科技公众号
“掌”握科技鲜闻 (微信搜索techsina或扫描左侧二维码关注)

希音“打折”上市:700亿美金的“学费”过于昂贵
理工科天才的黄金时代
考验外卖平台基本功的时候到了
江西遂川泥石流灾害致1人死亡11人失联,现场附近省道中断,救援队员徒步抵达开展救援
China GT上海站赛车被撞后起火 FIST车队不满主办方救援:退出所有China GT系列赛
醉酒男子机舱闹事 被乘客合力制服绑成“木乃伊”
Cybercab在美出师不利 特斯拉一夜蒸发6000亿 还遭遇监管风波
央视曝光“幽灵外卖”乱象:无资质商家花 500 元就能上线外卖平台
椅随人动:清闲动态人机工学椅亮相IFA 2026
China GT 上海站发生赛车撞击起火重大事故,魅影车队 79 号车手现场救援视频流出
特斯拉Cybercab上路当天遭NHTSA调查:没方向盘没踏板 自己认证存合规风险
GPT-6 Astra 发布 48 小时,十大邪修玩法来了!
GPT-6 Astra 模型发布,OpenAI 总裁布罗克曼自信放话“欢迎来到 AGI 时代”