Команда Qwen опубликовала Qwen-Drive-1.0 — визуально-языковую фундаментальную модель для автономного вождения

Alibaba

исследования офиц. + СМИ 2 ист. ~1 мин

Опубликовано 31 августа (arXiv 2609.00111) авторами Qwen/Alibaba и HUST: Qwen-Drive-1.0 расширяет предобученный VLM-бэкбон перцепционной головой в bird's-eye-view с совместным 3D-детектированием, семантической оккупантностью и сегментацией карты, плюс Planning Expert, генерирующий траектории эго. Поэтапная схема обучения смешивает драйвинговую супервизию с общими визуально-языковыми данными; оценки охватывают open-loop, псевдо-closed-loop и closed-loop режимы. Веса пока не выпущены; статья вошла в Hugging Face Daily Papers 2 сентября.

Почему это важно

Первая фундаментальная модель для вождения под брендом Qwen, пока только статья

Важность: 2/5

Заметная статья о доменной фундаментальной модели от команды Qwen

Источники