Яндекс объединил VLM и LLM в единую омни-модель, на которой работает Alice AI
Yandex
Инженеры Яндекса рассказали, как отдельные текстовая LLM и vision-модель, стоявшие за Alice AI, были объединены в одну омни-модель через архитектуру mixture-of-experts, с последовательным omni-предобучением плюс SFT/RL alignment и ~300 отслеживаемых бенчмарков. Сравнительные оценки показывают победу над собственной февральской моделью Яндекса 57:43 и над Qwen 3.5 397B (no-thinking) 59:41, при отставании от Gemini 3.1 Pro и Qwen 3.5 thinking.
Почему это важно
первый детальный публичный рассказ об архитектуре флагманской мультимодальной модели Alice AI
Важность: 3/5
раскрытие архитектуры флагманской модели от Яндекса с конкурентными оценками