Ежедневный дайджест

11 пунктов · ~11 мин · Неделя 2026-W30

Обязательно к прочтению (2)

AMD и Anthropic объявили о сделке на 2 гигаватта Instinct MI450 с инвестицией AMD до $5 млрд

Anthropic
индустрия офиц. + СМИ 2 ист. ~1 мин

22 июля 2026 года AMD и Anthropic объявили о стратегическом партнёрстве по развёртыванию до 2 гигаватт GPU AMD Instinct серии MI450 (через Instinct MI455X в стоечных системах AMD Helios с CPU EPYC 'Venice' и сетевыми решениями Pensando) для масштабирования вычислений под Claude; развёртывание первого гигаватта начнётся в первой половине 2027 года. AMD обязалась инвестировать в Anthropic до $5 млрд, а компании будут сотрудничать над использованием Claude для оптимизации рабочих нагрузок под GPU AMD и ускорения разработки ROCm.

Почему это важно
Крупный шаг диверсификации поставок вычислений для Anthropic в сторону от исключительной зависимости от Nvidia/TPU, напрямую влияющий на будущие мощности и цены Claude, а также вотум доверия к программному стеку ROCm от AMD со стороны ведущей AI-лаборатории.

ABot-World-0: бесконечный интерактивный мир на одном настольном GPU

Alibaba AMAP CV Lab
исследования официальный 2 ист. ~1 мин

Видео-модель мира, обученная на AAA-играх, симуляционных движках и интернет-видео, поддерживающая рендеринг в реальном времени — 720p видео до 16 кадров в секунду на одном настольном GPU NVIDIA RTX 5090 благодаря техникам дистилляции, снижающим накопление сдвига распределения, и унифицированному управлению в стиле клавиатуры.

Почему это важно
Получила 835 лайков на Hugging Face Daily Papers, став безоговорочно самой популярной статьёй за этот период и сигнализируя о сильном интересе сообщества к интерактивным моделям мира на потребительском железе.

Стоит знать (5)

Microsoft и Mistral расширяют стратегическое партнёрство многомиллиардной сделкой по европейской инфраструктуре

Mistral
индустрия официальный 1 ист. ~1 мин

21 июля 2026 года Microsoft и Mistral объявили о расширении партнёрства: Microsoft профинансирует рост дата-центров Mistral в Европе (на GPU NVIDIA Vera Rubin) и интегрирует модели Mistral Medium 3.5 и OCR 4 в Microsoft Foundry и Copilot Studio, ориентируясь на регулируемые отрасли, которым требуется суверенитет данных.

Почему это важно
Усиливает зависимость Mistral от облачного стека Microsoft и интеграцию с ним, позиционируя модели Mistral как европейско-суверенную альтернативу внутри Azure для регулируемых секторов.

SLAI T-Rex: полнопараметрическое пост-обучение семейства DeepSeek-V4 на Ascend SuperPOD

SLAI
исследования официальный 2 ист. ~1 мин

Сообщается о полнопараметрическом пост-обучении моделей mixture-of-experts DeepSeek-V4 с триллионом параметров на кластерах NPU Huawei Ascend вместо GPU, с достижением 34,22% утилизации FLOPs модели (в 2,93 раза выше открытого базового рецепта) за счёт иерархического параллелизма и оптимизации на уровне ядер, а также использованием полученной инфраструктуры для обучения специализированной модели для исследования операций, достигающей 71,81% zero-shot Pass@1.

Почему это важно
Демонстрирует, что пост-обучение LLM триллионного масштаба уже практически осуществимо вне экосистемы Nvidia GPU — значимая веха для инфраструктурной независимости незападных вычислений для ИИ.

Beyond Euclidean Clipping: преодоление коллапса исследования в LLM RL через риманову изометрическую оптимизацию политики

исследования официальный 2 ист. ~1 мин

Показывает, что алгоритмы в стиле PPO-Clip, применяемые в RL для LLM, страдают от 'коллапса исследования' из-за несоответствия евклидового клиппинга истинной геометрии пространства политик, и предлагает RIPO (Riemannian Isometric Policy Optimization), которая учитывает эту геометрию для лучшего баланса между исследованием и эксплуатацией, показывая улучшение до 60% над GRPO на AIME24.

Почему это важно
Затрагивает ключевую слабость рецептов RL в стиле GRPO, ставших стандартом для обучения рассуждающих LLM, с крупным заявленным приростом на широко используемом бенчмарке математических рассуждений (AIME24).

DataFlow-Harness: обоснованная платформа кодовых агентов для построения редактируемых пайплайнов данных для LLM

Peking University
исследования официальный 2 ист. ~1 мин

Представляет платформу, где кодовые агенты LLM строят структурированные, редактируемые графы рабочих процессов пайплайнов данных (вместо неструктурированных скриптов) через слой протокола с открытыми операторами плюс веб-интерфейс, синхронизирующий чат с визуальным редактированием, достигая 93,3% сквозного показателя прохождения на бенчмарке при снижении затрат на 72,5% по сравнению со стандартными подходами генерации скриптов.

Почему это важно
Получила 122 лайка на Hugging Face Daily Papers и решает практическую проблему (хрупкие, неподдерживаемые пайплайны данных, сгенерированные LLM), актуальную для всех, кто строит промышленные рабочие процессы данных для LLM.

OpenAI представила Presence — управляемую платформу корпоративных AI-агентов

OpenAI
инструменты официальный 1 ист. ~1 мин

22 июля 2026 года OpenAI анонсировала Presence — управляемую корпоративную платформу для развёртывания голосовых и текстовых AI-агентов с политиками, guardrails, правилами эскалации и мониторингом для критичных сценариев вроде поддержки клиентов, продаж и IT/HR. По заявлению OpenAI, Presence уже обрабатывает около 75% входящих запросов в собственную службу поддержки компании.

Почему это важно
Отмечает выход OpenAI на рынок управляемого, высококонтактного развёртывания корпоративных агентов (через Forward Deployed Engineers) — иной подход к выходу на рынок по сравнению с самообслуживаемыми API-продуктами.
Справочно (4)

Mage-Flow: эффективная базовая модель нативного разрешения для генерации и редактирования изображений

Microsoft
исследования официальный 2 ист. ~1 мин

Компактная система генерации/редактирования изображений на 4 млрд параметров с нативным разрешением, сочетающая Mage-VAE (токенизатор с одношаговым кодированием, снижающий стоимость токенизации более чем на порядок по сравнению с сильными публичными VAE) с диффузионным трансформером; вариант Turbo выполняет вывод за 4 шага, генерируя изображения 1024x1024 за 0,59 секунды на одном GPU, оставаясь конкурентоспособным по бенчмаркам.

Почему это важно
Показывает, что компактная модель (4 млрд параметров) может соответствовать по качеству более крупным системам генерации изображений, работая при этом на порядок дешевле — актуально для развёртывания генерации изображений на устройстве и с учётом затрат.

Anthropic запустила коннектор Economic Index для Claude

Anthropic
инструменты официальный 1 ист. ~1 мин

Anthropic выпустила коннектор, позволяющий пользователям Claude запрашивать данные Anthropic Economic Index прямо внутри диалога — с информацией о том, какие профессии и задачи автоматизируются ИИ. Коннектор доступен через меню коннекторов в claude.ai и работает с любой моделью Claude.

Почему это важно
Делает набор данных об экономическом влиянии от Anthropic доступным не только исследователям и политикам, но и обычным пользователям прямо внутри продукта.

Claude Code v2.1.218 переносит /code-review в фоновый субагент

Anthropic
инструменты официальный 1 ист. ~1 мин

Вслед за ограничением параллелизма субагентов в v2.1.217, Claude Code v2.1.218 (22 июля 2026) переводит /code-review в фоновый субагент вместо заполнения основного диалога, добавляет автодополнение emoji-shortcode в поле ввода промпта и исправляет повреждение путей Windows с сегментами с префиксом \u, устаревшие счётчики токенов в /context, отсутствие срабатывания auto-compact для Claude Opus 4.8 на Bedrock, а также делает так, что ошибки подключения MCP теперь показывают HTTP-статус/текст ошибки в `claude mcp list` и `/mcp`.

Почему это важно
Запуск code review в фоновом субагенте избавляет основной диалог от загромождения во время длинных агентных сессий, продолжая серию исправлений надёжности системы субагентов Claude Code.

vLLM представляет предварительную поддержку промышленного масштаба для Kimi K3 от Moonshot AI перед релизом весов

vLLM / Moonshot AI
инструменты официальный 1 ист. ~1 мин

Проект vLLM опубликовал 22 июля 2026 года пост в блоге с предварительным анонсом поддержки промышленного масштаба для Kimi K3 — модели Moonshot AI на 2,8 трлн параметров с нативным зрением и окном контекста в 1 миллион токенов — в преддверии запланированного релиза весов 27 июля. Работа включает разделение размера физического блока состояния KDA и гранулярности сопоставления префиксов для более эффективного переиспользования кэша, а также оптимизации ядер, мультимодальности и оборудования (NVIDIA и AMD).

Почему это важно
Показывает, как инференс-движки соревнуются за готовность поддержки в день релиза крупной открытой модели, и представляет новые техники кэширования для вариантов внимания в стиле KDA.