今
🎯 科技 · AI+自动驾驶🔥 阿里千问开源Qwen-Drive-1.0-4B,首个面向自动驾驶的视觉语言基础模型,端到端闭环安全性全面提升9月6日,阿里千问正式开源Qwen-Drive-1.0-4B... 展开 ▼
🎯 科技 · AI+自动驾驶
🔥 阿里千问开源Qwen-Drive-1.0-4B,首个面向自动驾驶的视觉语言基础模型,端到端闭环安全性全面提升
9月6日,阿里千问正式开源Qwen-Drive-1.0-4B,这是业界首个面向自动驾驶场景的视觉语言基础模型。该模型基于Qwen3.5-4B构建,在预训练阶段统一了3D感知与视觉问答能力,并进一步扩展至运动规划环节,完整覆盖了自动驾驶从"看见"到"决策"的全链条。官方表示,Qwen-Drive-1.0完全保留了预训练VLM的原始架构,这意味着开发者可以在现有大模型能力基础上直接做自动驾驶微调和部署,无需从零搭建设计框架。开源即发布,这是阿里在自动驾驶AI赛道上的一次重磅落子。
值得一提的是,#阿里千问开源Qwen-Drive自动驾驶模型# 此次开源的4B参数版本在保持轻量化的同时,依然实现了从开环预测到闭环驾驶的全面评估覆盖。模型仅使用公开来源构建规划样本,统一了各数据集的轨迹格式,大大降低了行业门槛。
Qwen-Drive-1.0的核心突破在于强化学习阶段的优化。经过RL训练后,该模型仅以微小的开环位移误差为代价,换来了在人类偏好对齐和闭环安全性方面的全面提升。这意味着模型不仅能在静态场景下准确识别路况,更能在动态驾驶过程中做出更符合人类驾驶习惯的决策,减少"机器感"操作带来的安全隐患。安全性是自动驾驶的生死线,阿里在这里下了硬功夫。
从技术路线上看,Qwen-Drive选择了一条不同于纯视觉方案的路径——通过视觉语言模型的统一架构,将感知、理解、规划融为一体,避免了传统自动驾驶中各模块独立训练、误差叠加的弊端。这种端到端的设计思路,正逐渐成为行业主流方向。
此次开源恰逢中国自动驾驶行业加速发展的关键窗口期。豪威集团CIS市占率已达13%跃居全球第二,国产传感器硬件基础日趋扎实;而阿里千问将大模型能力直接下沉到自动驾驶场景,补齐了软件算法层面的关键拼图。硬件+软件双轮驱动,中国自动驾驶的自主可控路径愈发清晰。
开源社区反应热烈,开发者普遍认为4B参数版本对消费级硬件友好,推理成本可控,适合车载嵌入式部署。业内分析指出,Qwen-Drive的开源或将加速自动驾驶中小团队的创新速度,推动行业从头部巨头垄断向多元生态竞争转变。9月6日开源公告一出,github星标短时间内快速攀升,充分说明市场热度。
综合IT之家、差评世界报道 | 2026年9月7日
收起 ▲