DeepSeek открыла веса V4-Flash-Vision-Exp — первой мультимодальной модели линейки V4 — под MIT

DeepSeek

модели/LLM официальный 2 ист. ~1 мин

31 августа 2026 DeepSeek опубликовала веса DeepSeek-V4-Flash-Vision-Exp на Hugging Face (репозиторий создан 2026-08-31T06:16Z) — первая экспериментальная мультимодальная модель семейства V4. MoE-модель на 305 млрд параметров (лицензия MIT, FP8/BF16) расширяет DeepSeek-V4-Flash vision-энкодером и aligner'ом, attention DFlash и путём speculative-декодирования DSpark для SGLang. Самоотчётные метрики: Terminal Bench 2.1 — 83,9, ApexBench Pass@1 — 36,5 (против 26,2 у текстовой V4-Flash-0731). Модель с 21 августа была доступна только через API; публикация весов делает её крупнейшей открытой MIT-мультимодальной моделью от китайской лаборатории на сегодня.

Почему это важно

Открытая мультимодальная модель frontier-масштаба переходит в полностью открытый MIT-тир всего через несколько дней после API-дебюта — сигнал, что DeepSeek расширяет линейку V4 от текста к vision-агентной работе.

Важность: 4/5

Флагманский релиз открытых весов мультимодальной модели, официальные источники

Источники