-
DeepSeek V4: официальный open-source релиз с Day-0 адаптацией под Huawei Ascend
DeepSeek
models-llm
-
Tencent официально выпускает Hunyuan Hy3: 295B MoE-модель с агентными и рассуждательными возможностями
Tencent
models-llm
-
Moonshot Kimi K3: релиз открытых весов модели MoE на 2,8 трлн параметров
Moonshot AI
models-llm
-
MiniMax выпускает M3: открытая фронтирная модель с контекстом 1M токенов и архитектурой MSA
MiniMax
models-llm
-
NVIDIA Nemotron 3 Ultra: открытая модель 550B MoE теперь доступна для агентных задач
NVIDIA
models-llm
-
MiniMax M3 с открытыми весами: контекст 1M, MoE и кодирование на уровне лучших моделей
MiniMax
models-llm
-
Zhipu AI открывает GLM-5.2 под лицензией MIT с контекстом 1M токенов
Zhipu AI
models-llm
-
Zhipu AI выпускает открытые веса GLM-5.2: 753B MoE с контекстом 1M токенов под лицензией MIT
Zhipu AI / Z.ai
models-llm
-
ByteDance представляет флагманскую LLM Doubao-Seed-2.1 Pro на конференции FORCE
ByteDance / Doubao
models-llm
-
Сбер выпускает GigaChat 3.5 Ultra: флагманская open-source MoE-модель на 432B
Sber
models-llm
-
Tencent выпускает Hunyuan Hy3: открытая MoE-модель на 295B параметров под лицензией Apache 2.0
Tencent
models-llm
-
Thinking Machines Lab выпустила Inkling: мультимодальную MoE-модель на 975 млрд параметров с открытыми весами
Thinking Machines Lab
models-llm
-
Moonshot AI выпустила Kimi K3 — модель с открытыми весами на 2,8 трлн параметров
Moonshot AI
models-llm
-
Zyphra выпускает ZAYA1-8B: открытая рассуждающая MoE-модель, обученная на оборудовании AMD
Zyphra
models-llm
-
Lance: 3B Unified Multimodal Model for Understanding, Generation, and Editing (314 HF upvotes)
ByteDance Research
research
-
JetBrains публикует исходный код Mellum2: 12B MoE-модель для кодирования в мульти-модельных пайплайнах
JetBrains
models-llm
-
Cohere North Mini Code: 30B MoE-модель под Apache 2.0 для агентных рабочих процессов
Cohere
models-llm
-
Kimi K2.7-Code HighSpeed: рост производительности в 6× для продакшн-пайплайнов агентов по коду
Moonshot AI
models-llm
-
Prime Intellect выпускает prime-rl v0.6.0 для агентного RL на триллионно-параметрических MoE-моделях
Prime Intellect
research
-
DeepReinforce выпускает Ornith-1.0: открытые модели для программирования, самостоятельно обучающие свои RL-каркасы
DeepReinforce
tools
-
Стабильный релиз DeepSeek V4 запланирован на середину июля с первым почасовым API-ценообразованием
DeepSeek
models-llm
-
DeepSeek подтверждает официальный выпуск V4 в середине июля и вводит пиковое ценообразование API
DeepSeek
models-llm
-
NVIDIA выпускает Nemotron-Labs-Audex-30B-A3B: единая MoE-модель для аудио и текста
NVIDIA
audio
-
DeepSeek V4 перешла из превью в общий доступ с тарификацией API по часам пиковой нагрузки
DeepSeek
models-llm
-
Alibaba представила превью Qwen3.8-Max — мультимодального флагмана с 2,4 трлн параметров
Alibaba / Qwen
models-llm
-
Kwai Keye-VL-2.0: открытая мультимодальная MoE-модель 30B с контекстом 256K для длинного видео
Kwai
research
-
Moonshot AI выпускает Kimi K2.7-Code: открытая модель с 1T параметрами для программирования и поддержкой зрения
Moonshot AI
models-llm
-
Ring-Zero: масштабирование Zero RL до триллиона параметров с возникающими паттернами рассуждения
Ant Group
research
-
SLAI T-Rex: полнопараметрический post-training семейства DeepSeek-V4 на Ascend SuperPOD
SLAI
research
-
Технический отчёт Kimi K3: подробности об архитектуре Kimi Delta Attention и Stable LatentMoE
Moonshot AI
research
-
vLLM добавляет поддержку MiniMax M3 с открытыми весами в день выхода: разреженное внимание с контекстом 1M токенов
MiniMax
tools
-
Kimi K2.7 Code (1T параметров, 32B активных) расширяется на GitHub Copilot Business и Enterprise
Moonshot AI
tools
-
SLAI T-Rex: полнопараметрическое пост-обучение семейства DeepSeek-V4 на Ascend SuperPOD
SLAI
research
-
Zhipu AI выпускает GLM-5.2: MoE с 744B параметрами, контекстом 1M токенов и фокусом на программирование
Zhipu AI
models-llm
-
GLM-5.2: MoE-модель для программирования от Zhipu AI на 744B параметров под лицензией MIT вызывает опасения в сфере кибербезопасности
Zhipu AI / Z.ai
models-llm
-
Alibaba открывает широкий доступ к Qwen3.8-Max через API, запускает публичную бету QwenWork
Alibaba / Qwen
models-llm
-
Сбер представил Kandinsky 6.0 Image — флагманскую модель генерации изображений
Sber
image
-
ELDR: маршрутизация с учётом локальности экспертов снижает задержку при обслуживании MoE-моделей на 14%
Microsoft Research
research
-
llama.cpp: поддержка Tencent Hunyuan 3, спекулятивное декодирование Minimax2 Eagle3 и SYCL Fused MoE
tools
-
xHC: Expanded Hyper-Connections масштабируют параллелизм residual-потока за прежние пределы
Shanghai Jiao Tong University / Xiaohongshu / USTC / Peking University / CUHK
research