IBM выпускает reasoning-LLM Granite 4.2 (3B/8B/30B, Apache 2.0, контекст 512K), обученные на ~15T токенов с GRPO RL на GB200 NVL72

IBM

модели/LLM официальный 3 ист. ~1 мин

25 августа 2026 года IBM выпустила Granite 4.2 — первое семейство плотных decoder-only reasoning-LLM в размерах 3B/8B/30B под Apache 2.0. Предобучено с нуля на ~15T токенов по пятифазной стратегии с расширением контекста до 512K; SFT на ~7.2M примеров (31.6% агентских, 68.4% неагентских); многоступенчатый асинхронный GRPO RL — фундаментальный RLVR для всех размеров, агентский RL (SWE → Terminal → Search) для 8B/30B, RLHF для безопасности и длины рассуждений. Режимы thinking / non-thinking / low-effort; нативный OpenAI-совместимый tool-calling API; 12 языков. Обучено на кластере NVIDIA GB200 NVL72 в CoreWeave с использованием NeMo-RL и NeMo-Gym. Квантизации FP8/NVFP4/MXFP4 и 14 вариантов GGUF. 30B достигает 89.17 на AIME25, 57.00 на SWE-Bench Verified, 62.00 на τ³-bench.

Почему это важно

Первое семейство плотных reasoning-LLM под Apache 2.0 от западной frontier-лаборатории в трёх размерах, все с нативным tool-calling и контекстом 512K — конкурентоспособно с закрытыми агентскими API на агентских бенчмарках и поставляется с полным RL-стеком.

Важность: 4/5

первое семейство плотных reasoning-LLM под Apache 2.0 от западной лаборатории в 3 размерах, контекст 512K, агентский RL

Источники

официальный IBM Granite documentation