DeepSeek V4.1 Flash выходит в GA с открытыми весами по MIT и выводом V4 Pro из эксплуатации
DeepSeek
DeepSeek перевела V4.1 Flash из беты в полноценный релиз 10 сентября, опубликовав веса по лицензии MIT и технический отчёт на Hugging Face. Мультимодальный MoE на 552B параметров (8B активных на prefill, 16B на decode) использует Causal Encoder-Decoder с FP4-кешированием KV, сокращая постоянный кэш примерно до 1/8 от V4 Flash, поддерживает контекст 1M токенов и снижает цены Flash API примерно на 11–57%. С 14 сентября запросы к deepseek-v4-pro будут маршрутизироваться на новую модель.
Почему это важно
Первая продакшен-модель на новом архитектурном семействе DeepSeek даёт открытые веса уровня, близкого к frontier, при радикально меньшем расходе памяти и цене за токен, напрямую подрывая закрытые API-цены для long-context agent-нагрузок.
Важность: 4/5
Флагманский релиз открытых весов на новой архитектуре; официальные источники + Reuters и SiliconAngle