Ежедневный дайджест
8 пунктов · ~8 мин · Неделя 2026-W30
Обязательно к прочтению (1)
Anthropic выпустила Claude Opus 5
Anthropic24 июля 2026 года Anthropic представила Claude Opus 5 — более быструю и экономичную модель уровня Opus, которая приближается к передовому уровню интеллекта Claude Fable 5 при той же цене $5/$25 за миллион токенов, что и у предшественника Opus 4.8. Модель стала дефолтной в Claude Max, самой мощной из доступных в Claude Pro, и в тот же день появилась в GitHub Copilot для сложных, долго выполняющихся задач по написанию кода.
Стоит знать (2)
Project Pilot от Anthropic проверяет, способны ли AI-модели управлять дронами
AnthropicFrontier Red Team компании Anthropic совместно с Andon Labs опубликовали Project Pilot и новый бенчмарк Drone-Bench, оценивающий способность AI-моделей автономно управлять квадрокоптером в помещении для поиска и сопровождения человека. Пятнадцать моделей от трёх разработчиков были оценены по пяти подзадачам (реконструкция, локализация, навигация, обнаружение, слежение); лидером стала Claude Fable 5, однако сбои на этапе реконструкции по-прежнему мешают надёжной сквозной автономной навигации.
OpenAI добавила голосовое управление ChatGPT в десктоп-приложение с поддержкой Codex
OpenAIOpenAI выпустила ChatGPT Voice для десктоп-приложений на macOS и Windows на базе GPT-Live, что позволяет пользователям голосом управлять компьютером и одновременно направлять несколько кодирующих агентов в ChatGPT Work или Codex. В том же обновлении Codex получил поддержку работы с несколькими папками в локальных проектах.
Справочно (5)
Midjourney выпустила V8.2 как новую модель по умолчанию
Midjourney24 июля 2026 года Midjourney сделала V8.2 версией модели по умолчанию — обновление сфокусировано на эстетике, качестве изображений и персонализации, а не на увеличении возможностей как таковых. Модель создаёт более креативные, смелые и сложные изображения и улучшает то, как профили Personalization отражают эстетические предпочтения пользователя.
LLM теряются при изменении намерений пользователя
Microsoft ResearchВ статье представлен фреймворк, преобразующий стандартные однооборотные задачи в многооборотные диалоги, где цель пользователя меняется в процессе общения, и проверяется, насколько хорошо LLM отслеживают эти изменения. Выяснилось, что высокая производительность в однооборотном режиме не переносится на этот сценарий с изменяющимися намерениями — точность существенно падает во всех семействах моделей.
NVIDIA-labs OO Agents: нативные объектно-ориентированные агенты на Python
NVIDIAВ статье предлагается представлять LLM-агентов в виде обычных объектов Python: методы — это действия, поля — состояние, докстринги — промпты, а аннотации типов — контракты, при этом методы-заглушки дополняются LLM во время выполнения, а обычные методы выполняются как обычный код. Фреймворк оценивается на SWE-bench Verified, Terminal-Bench 2.0 и ARC-AGI-3.
Вышли Claude Code v2.1.219 и v2.1.220
AnthropicClaude Code v2.1.219 (24 июля 2026) добавил Claude Opus 5 в качестве модели Opus по умолчанию с контекстом 1M, настройку sandbox.network.strictAllowlist для блокировки хостов вне allowlist, хук DirectoryAdded, поддержку вложенных субагентов до глубины 3 и отчёты mcp_server_errors в headless-режиме stream-json. v2.1.220 (25 июля 2026) последовал с исправлениями багов и улучшениями стабильности.
Вышел opencode v1.18.5 с адаптивным мышлением и исправлениями стабильности провайдеров
SST24 июля 2026 года sst/opencode выпустил v1.18.5, улучшив обработку адаптивного мышления Claude во всех форматах ответов, исправив сбои на этапе responses у OpenAI, стабилизировав кэширование промптов и историю рассуждений Mistral, исправив сохранение символических ссылок в результатах grep, а также добавив в десктоп-приложение поддержку текущего терминального транспорта сервера и таймлайнов сессий.