Команда Qwen опубликовала Qwen-Drive-1.0 — визуально-языковую фундаментальную модель для автономного вождения
Alibaba
Опубликовано 31 августа (arXiv 2609.00111) авторами Qwen/Alibaba и HUST: Qwen-Drive-1.0 расширяет предобученный VLM-бэкбон перцепционной головой в bird's-eye-view с совместным 3D-детектированием, семантической оккупантностью и сегментацией карты, плюс Planning Expert, генерирующий траектории эго. Поэтапная схема обучения смешивает драйвинговую супервизию с общими визуально-языковыми данными; оценки охватывают open-loop, псевдо-closed-loop и closed-loop режимы. Веса пока не выпущены; статья вошла в Hugging Face Daily Papers 2 сентября.
Почему это важно
Первая фундаментальная модель для вождения под брендом Qwen, пока только статья
Важность: 2/5
Заметная статья о доменной фундаментальной модели от команды Qwen