Яндекс объединил VLM и LLM в единую омни-модель, на которой работает Alice AI

Yandex

модели/LLM официальный 1 ист. ~1 мин

Инженеры Яндекса рассказали, как отдельные текстовая LLM и vision-модель, стоявшие за Alice AI, были объединены в одну омни-модель через архитектуру mixture-of-experts, с последовательным omni-предобучением плюс SFT/RL alignment и ~300 отслеживаемых бенчмарков. Сравнительные оценки показывают победу над собственной февральской моделью Яндекса 57:43 и над Qwen 3.5 397B (no-thinking) 59:41, при отставании от Gemini 3.1 Pro и Qwen 3.5 thinking.

Почему это важно

первый детальный публичный рассказ об архитектуре флагманской мультимодальной модели Alice AI

Важность: 3/5

раскрытие архитектуры флагманской модели от Яндекса с конкурентными оценками

Источники