阿里千問開源自動駕駛視覺語言模型Qwen-Drive-1.0-4B

观点网

2026-09-07 15:16

  • 近日,阿里千問開源自動駕駛視覺語言模型Qwen-Drive-1.0-4B,基于Qwen3.5-4B構建,官方稱其為首個面向自動駕駛的視覺語言基礎模型,經強化學習後在人類偏好對齊與閉環安全性方面提升。

    觀點網訊:近日,阿里千問開源自動駕駛視覺語言模型Qwen-Drive-1.0-4B。該模型基于Qwen3.5-4B構建,參數規模為4B,官方稱其為首個面向自動駕駛的視覺語言基礎模型。

    官方介紹稱,該模型在預訓練階段統一了3D感知與視覺問答,並擴展至運動規劃,同時完全保留預訓練VLM原始架構。

    模型僅使用公開來源構建規劃樣本,統一各數據集軌迹格式,並從開環預測到閉環駕駛進行全面評估。

    經過強化學習後,該模型僅以微小的開環位移誤差為代價,實現了在人類偏好對齊和閉環安全性方面的全面提升。

    需要說明的是,“首個面向自動駕駛的視覺語言基礎模型”為官方說法,該4B規模模型的實際産業落地效果尚待觀察。

    免責聲明:本文内容與數據由觀點根據公開信息整理,不構成投資建議,使用前請核實。

    審校:楊毅



    相關話題讨論



    你可能感興趣的話題

    産業科技

    科技

    AI

    阿里千問

    自動駕駛