Ежедневный дайджест
11 пунктов · ~11 мин · Неделя 2026-W30
Обязательно к прочтению (2)
AMD и Anthropic объявили о сделке на 2 гигаватта Instinct MI450 с инвестицией AMD до $5 млрд
Anthropic22 июля 2026 года AMD и Anthropic объявили о стратегическом партнёрстве по развёртыванию до 2 гигаватт GPU AMD Instinct серии MI450 (через Instinct MI455X в стоечных системах AMD Helios с CPU EPYC 'Venice' и сетевыми решениями Pensando) для масштабирования вычислений под Claude; развёртывание первого гигаватта начнётся в первой половине 2027 года. AMD обязалась инвестировать в Anthropic до $5 млрд, а компании будут сотрудничать над использованием Claude для оптимизации рабочих нагрузок под GPU AMD и ускорения разработки ROCm.
ABot-World-0: бесконечный интерактивный мир на одном настольном GPU
Alibaba AMAP CV LabВидео-модель мира, обученная на AAA-играх, симуляционных движках и интернет-видео, поддерживающая рендеринг в реальном времени — 720p видео до 16 кадров в секунду на одном настольном GPU NVIDIA RTX 5090 благодаря техникам дистилляции, снижающим накопление сдвига распределения, и унифицированному управлению в стиле клавиатуры.
Стоит знать (5)
Microsoft и Mistral расширяют стратегическое партнёрство многомиллиардной сделкой по европейской инфраструктуре
Mistral21 июля 2026 года Microsoft и Mistral объявили о расширении партнёрства: Microsoft профинансирует рост дата-центров Mistral в Европе (на GPU NVIDIA Vera Rubin) и интегрирует модели Mistral Medium 3.5 и OCR 4 в Microsoft Foundry и Copilot Studio, ориентируясь на регулируемые отрасли, которым требуется суверенитет данных.
SLAI T-Rex: полнопараметрическое пост-обучение семейства DeepSeek-V4 на Ascend SuperPOD
SLAIСообщается о полнопараметрическом пост-обучении моделей mixture-of-experts DeepSeek-V4 с триллионом параметров на кластерах NPU Huawei Ascend вместо GPU, с достижением 34,22% утилизации FLOPs модели (в 2,93 раза выше открытого базового рецепта) за счёт иерархического параллелизма и оптимизации на уровне ядер, а также использованием полученной инфраструктуры для обучения специализированной модели для исследования операций, достигающей 71,81% zero-shot Pass@1.
Beyond Euclidean Clipping: преодоление коллапса исследования в LLM RL через риманову изометрическую оптимизацию политики
Показывает, что алгоритмы в стиле PPO-Clip, применяемые в RL для LLM, страдают от 'коллапса исследования' из-за несоответствия евклидового клиппинга истинной геометрии пространства политик, и предлагает RIPO (Riemannian Isometric Policy Optimization), которая учитывает эту геометрию для лучшего баланса между исследованием и эксплуатацией, показывая улучшение до 60% над GRPO на AIME24.
DataFlow-Harness: обоснованная платформа кодовых агентов для построения редактируемых пайплайнов данных для LLM
Peking UniversityПредставляет платформу, где кодовые агенты LLM строят структурированные, редактируемые графы рабочих процессов пайплайнов данных (вместо неструктурированных скриптов) через слой протокола с открытыми операторами плюс веб-интерфейс, синхронизирующий чат с визуальным редактированием, достигая 93,3% сквозного показателя прохождения на бенчмарке при снижении затрат на 72,5% по сравнению со стандартными подходами генерации скриптов.
OpenAI представила Presence — управляемую платформу корпоративных AI-агентов
OpenAI22 июля 2026 года OpenAI анонсировала Presence — управляемую корпоративную платформу для развёртывания голосовых и текстовых AI-агентов с политиками, guardrails, правилами эскалации и мониторингом для критичных сценариев вроде поддержки клиентов, продаж и IT/HR. По заявлению OpenAI, Presence уже обрабатывает около 75% входящих запросов в собственную службу поддержки компании.
Справочно (4)
Mage-Flow: эффективная базовая модель нативного разрешения для генерации и редактирования изображений
MicrosoftКомпактная система генерации/редактирования изображений на 4 млрд параметров с нативным разрешением, сочетающая Mage-VAE (токенизатор с одношаговым кодированием, снижающий стоимость токенизации более чем на порядок по сравнению с сильными публичными VAE) с диффузионным трансформером; вариант Turbo выполняет вывод за 4 шага, генерируя изображения 1024x1024 за 0,59 секунды на одном GPU, оставаясь конкурентоспособным по бенчмаркам.
Anthropic запустила коннектор Economic Index для Claude
AnthropicAnthropic выпустила коннектор, позволяющий пользователям Claude запрашивать данные Anthropic Economic Index прямо внутри диалога — с информацией о том, какие профессии и задачи автоматизируются ИИ. Коннектор доступен через меню коннекторов в claude.ai и работает с любой моделью Claude.
Claude Code v2.1.218 переносит /code-review в фоновый субагент
AnthropicВслед за ограничением параллелизма субагентов в v2.1.217, Claude Code v2.1.218 (22 июля 2026) переводит /code-review в фоновый субагент вместо заполнения основного диалога, добавляет автодополнение emoji-shortcode в поле ввода промпта и исправляет повреждение путей Windows с сегментами с префиксом \u, устаревшие счётчики токенов в /context, отсутствие срабатывания auto-compact для Claude Opus 4.8 на Bedrock, а также делает так, что ошибки подключения MCP теперь показывают HTTP-статус/текст ошибки в `claude mcp list` и `/mcp`.
vLLM представляет предварительную поддержку промышленного масштаба для Kimi K3 от Moonshot AI перед релизом весов
vLLM / Moonshot AIПроект vLLM опубликовал 22 июля 2026 года пост в блоге с предварительным анонсом поддержки промышленного масштаба для Kimi K3 — модели Moonshot AI на 2,8 трлн параметров с нативным зрением и окном контекста в 1 миллион токенов — в преддверии запланированного релиза весов 27 июля. Работа включает разделение размера физического блока состояния KDA и гранулярности сопоставления префиксов для более эффективного переиспользования кэша, а также оптимизации ядер, мультимодальности и оборудования (NVIDIA и AMD).