Ежедневный дайджест

8 пунктов · ~8 мин · Неделя 2026-W30

Обязательно к прочтению (1)

Anthropic выпустила Claude Opus 5

Anthropic
модели/LLM офиц. + СМИ 5 ист. ~1 мин

24 июля 2026 года Anthropic представила Claude Opus 5 — более быструю и экономичную модель уровня Opus, которая приближается к передовому уровню интеллекта Claude Fable 5 при той же цене $5/$25 за миллион токенов, что и у предшественника Opus 4.8. Модель стала дефолтной в Claude Max, самой мощной из доступных в Claude Pro, и в тот же день появилась в GitHub Copilot для сложных, долго выполняющихся задач по написанию кода.

Почему это важно
Opus 5 устанавливает новый рекорд по бенчмаркам, связанным с написанием кода и интеллектуальной работой, таким как Frontier-Bench и GDPval-AA, при этом стоит дешевле, чем у конкурирующих флагманов, а её появление в GitHub Copilot в день релиза показывает, насколько быстро передовые модели теперь распространяются в сторонние инструменты для разработчиков.

Стоит знать (2)

Project Pilot от Anthropic проверяет, способны ли AI-модели управлять дронами

Anthropic
исследования официальный 1 ист. ~1 мин

Frontier Red Team компании Anthropic совместно с Andon Labs опубликовали Project Pilot и новый бенчмарк Drone-Bench, оценивающий способность AI-моделей автономно управлять квадрокоптером в помещении для поиска и сопровождения человека. Пятнадцать моделей от трёх разработчиков были оценены по пяти подзадачам (реконструкция, локализация, навигация, обнаружение, слежение); лидером стала Claude Fable 5, однако сбои на этапе реконструкции по-прежнему мешают надёжной сквозной автономной навигации.

Почему это важно
Исследование фиксирует, насколько близко AI-модели подошли к автономному управлению физическим оборудованием для задач, похожих на наблюдение — это технология двойного назначения с прямыми последствиями для регулирования ИИ и безопасности в физическом мире.

OpenAI добавила голосовое управление ChatGPT в десктоп-приложение с поддержкой Codex

OpenAI
инструменты офиц. + СМИ 3 ист. ~1 мин

OpenAI выпустила ChatGPT Voice для десктоп-приложений на macOS и Windows на базе GPT-Live, что позволяет пользователям голосом управлять компьютером и одновременно направлять несколько кодирующих агентов в ChatGPT Work или Codex. В том же обновлении Codex получил поддержку работы с несколькими папками в локальных проектах.

Почему это важно
Голосовое управление агентными процессами разработки продвигает модель взаимодействия OpenAI без использования рук ещё глубже в инструменты разработчиков, напрямую конкурируя с продуктами Anthropic и других лабораторий для агентного программирования.
Справочно (5)

Midjourney выпустила V8.2 как новую модель по умолчанию

Midjourney
изображения официальный 1 ист. ~1 мин

24 июля 2026 года Midjourney сделала V8.2 версией модели по умолчанию — обновление сфокусировано на эстетике, качестве изображений и персонализации, а не на увеличении возможностей как таковых. Модель создаёт более креативные, смелые и сложные изображения и улучшает то, как профили Personalization отражают эстетические предпочтения пользователя.

Почему это важно
Превращение V8.2 в дефолтную модель платформы меняет базовый стиль вывода для большой пользовательской базы Midjourney и совершенствует функцию Personalization — одно из ключевых отличий сервиса от других инструментов генерации изображений по тексту.

LLM теряются при изменении намерений пользователя

Microsoft Research
исследования официальный 2 ист. ~1 мин

В статье представлен фреймворк, преобразующий стандартные однооборотные задачи в многооборотные диалоги, где цель пользователя меняется в процессе общения, и проверяется, насколько хорошо LLM отслеживают эти изменения. Выяснилось, что высокая производительность в однооборотном режиме не переносится на этот сценарий с изменяющимися намерениями — точность существенно падает во всех семействах моделей.

Почему это важно
Статья выявляет слепое пятно в текущей методологии оценки моделей — модели, выглядящие компетентными на статичных бенчмарках, могут серьёзно проваливаться при отслеживании меняющихся целей, а это ключевая способность для реальных совместных агентов.

NVIDIA-labs OO Agents: нативные объектно-ориентированные агенты на Python

NVIDIA
исследования официальный 2 ист. ~1 мин

В статье предлагается представлять LLM-агентов в виде обычных объектов Python: методы — это действия, поля — состояние, докстринги — промпты, а аннотации типов — контракты, при этом методы-заглушки дополняются LLM во время выполнения, а обычные методы выполняются как обычный код. Фреймворк оценивается на SWE-bench Verified, Terminal-Bench 2.0 и ARC-AGI-3.

Почему это важно
Предлагает лёгкую, нативную для кода абстракцию построения агентов, объединяющую детерминированную логику и логику на основе LLM в одном объекте — альтернативу фреймворкам на основе шаблонов промптов или графов.

Вышли Claude Code v2.1.219 и v2.1.220

Anthropic
инструменты официальный 2 ист. ~1 мин

Claude Code v2.1.219 (24 июля 2026) добавил Claude Opus 5 в качестве модели Opus по умолчанию с контекстом 1M, настройку sandbox.network.strictAllowlist для блокировки хостов вне allowlist, хук DirectoryAdded, поддержку вложенных субагентов до глубины 3 и отчёты mcp_server_errors в headless-режиме stream-json. v2.1.220 (25 июля 2026) последовал с исправлениями багов и улучшениями стабильности.

Почему это важно
Ужесточает контроль сетевого доступа в песочнице и расширяет возможности вложенных субагентов — оба изменения важны для команд, использующих Claude Code в автоматизированных/CI-пайплайнах.

Вышел opencode v1.18.5 с адаптивным мышлением и исправлениями стабильности провайдеров

SST
инструменты официальный 1 ист. ~1 мин

24 июля 2026 года sst/opencode выпустил v1.18.5, улучшив обработку адаптивного мышления Claude во всех форматах ответов, исправив сбои на этапе responses у OpenAI, стабилизировав кэширование промптов и историю рассуждений Mistral, исправив сохранение символических ссылок в результатах grep, а также добавив в десктоп-приложение поддержку текущего терминального транспорта сервера и таймлайнов сессий.

Почему это важно
Продолжается быстрая итерация над ведущим open-source терминальным агентом для написания кода, с исправлениями, затрагивающими нескольких крупных провайдеров моделей (Claude, OpenAI, Mistral), которые в opencode используются взаимозаменяемо.