Ежедневный дайджест

15 пунктов · ~15 мин · Неделя 2026-W31

Обязательно к прочтению (3)

Claude Mythos Preview от Anthropic взломала постквантовую схему HAWK и улучшила атаку на AES

Anthropic
исследования офиц. + СМИ 2 ист. ~1 мин

Anthropic опубликовала исследование, показывающее, что Claude Mythos Preview обнаружила ранее неизвестную атаку, вдвое сокращающую запас постквантовой стойкости подписи HAWK, а также атаку на AES с уменьшённым числом раундов, в 200–800 раз более быструю — всё это найдено примерно за 60 часов с помощью мультиагентной исследовательской системы. Anthropic также выпустила CryptanalysisBench, созданный совместно с ETH Zurich, Тель-Авивским университетом, Университетом Хайфы и TU Berlin.

Почему это важно
Первая публичная демонстрация того, как AI-ассистированный криптоанализ пробивает значимые запасы стойкости схем, переживших годы экспертной проверки людьми, хотя Anthropic утверждает, что ни одна продакшн-система сейчас не затронута.

Google DeepMind представила Gemini Robotics 2 для управления всем телом гуманоидов

Google DeepMind
исследования офиц. + СМИ 2 ист. ~1 мин

Google DeepMind выпустила Gemini Robotics 2, Gemini Robotics ER 2 и Gemini Robotics On-Device 2, дав гуманоидным роботам рассуждение для управления всем телом — теперь они могут ходить, приседать, манипулировать объектами и координироваться с другими роботами при выполнении многошаговых задач. ER 2 доступна через Google Cloud, Gemini API и Google AI Studio.

Почему это важно
Расширяет возможности рассуждения Gemini с верхней части тела робота на полное управление телом — пробел в возможностях, который конкуренты пока не закрыли.

TurboVLA: модель «зрение-язык-действие» в реальном времени на 32 Гц на RTX 4090 с менее чем 1 ГБ VRAM

исследования офиц. + СМИ 2 ист. ~1 мин

Переформулирует моделирование «зрение-язык-действие» как прямое отображение V+L в действия вместо маршрутизации через крупную языковую модель, достигая среднего успеха 97.7% на LIBERO всего с 0.2 млрд параметров, задержкой 31.2 мс и менее 1 ГБ VRAM на потребительской RTX 4090.

Почему это важно
Набрала 122 голоса в HuggingFace Daily Papers за 2026-07-30; сравнима или превосходит гораздо более крупные VLA-системы на базе LLM, делая управление роботом в реальном времени осуществимым на потребительском железе.

Стоит знать (5)

OpenAI резко снижает цены API для GPT-5.6 Luna и Terra, добавляет режим Fast

OpenAI
индустрия офиц. + СМИ 2 ист. ~1 мин

OpenAI снизила цены на GPT-5.6 Luna на 80% (до $0.20/$1.20 за миллион входных/выходных токенов) и на Terra — на 20%, объяснив это ростом эффективности благодаря внутренней работе по оптимизации с помощью моделей. Также в API появился режим Fast для Sol — до 2.5 раза быстрее по двойной цене, заменивший Priority Processing.

Почему это важно
Сигнализирует о падении стоимости инференса моделей, близких к передовым, и о новом рычаге компромисса «скорость/цена» для разработчиков, работающих с API.

Metis: базовая модель памяти

MemTensor
исследования офиц. + СМИ 2 ист. ~1 мин

Первый прототип базовой модели памяти, который даёт основной модели постоянное, динамически развивающееся состояние памяти, обновляемое без градиентов за один прямой проход, вместо внешнего поиска или дообучения.

Почему это важно
Заняла #1 место в HuggingFace Daily Papers за 2026-07-31 с 62 голосами; предлагает память как встроенную возможность модели, а не надстройку поиска, хотя авторы отмечают, что она всё ещё деградирует на задачах с длинным горизонтом из-за сжатия фиксированного размера.

Mage-VL: эффективная кодек-нативная потоковая мультимодальная базовая модель

Microsoft
исследования офиц. + СМИ 2 ист. ~1 мин

Мультимодальная модель на 4 млрд параметров с собственным визуальным токенизатором (Mage-ViT), который избирательно кодирует области видеопотока, богатые движением и остаточной информацией, вместо равномерной выборки кадров, сокращая число визуальных токенов более чем на 75% и обеспечивая до 3.5 раза более быстрый инференс.

Почему это важно
При 4 млрд параметров сравнима с Qwen3-VL-4B на общих VQA-задачах и превосходит значительно более крупную Phi-4-R-V-15B в пространственном и видеопонимании, решая проблему восприятия в реальном времени — известное слабое место VLM-моделей.

Cursor запускает поддержку iPad с полноценным ревью PR и чатами в режиме разделённого экрана

Cursor
инструменты официальный 1 ист. ~1 мин

Cursor выкатил поддержку iPad для всех платных планов (2026-07-29), добавив входящие, полноценный интерфейс ревью PR с комментариями, проверками и одобрениями, разметку изображений через Apple Pencil, интеграцию с системами контроля версий Bitbucket и Azure DevOps, обработку нескольких PR-сессий одновременно и закреплённые чаты в боковой панели для наблюдения за несколькими агентами с ревью в разделённом экране.

Почему это важно
Расширяет асинхронный агентный воркфлоу Cursor на мобильные устройства/планшеты, превращая ревью кода и управление PR в задачу «на ходу», а не только для десктопа.

MiniMax выпускает видеомодель Hailuo H3 со встроенным звуком и открытыми весами

MiniMax
видео офиц. + СМИ 2 ист. ~1 мин

MiniMax выпустила Hailuo H3 (MiniMax H3), третье поколение своей линейки видеомоделей Hailuo, генерирующей клипы до 15 секунд в нативном разрешении 2K с синхронизированным стереозвуком. Модель поддерживает всеобъемлющий референсный ввод (до 9 референсных изображений, 3 референсных видеоклипа, 3 референсных аудиоклипа), редактирование на основе инструкций и перенос движения между видео. MiniMax заявила, что откроет веса модели в течение нескольких дней, и установила цену примерно в треть от конкурирующих продуктов, позиционируя её напрямую против Seedance 2.0 от ByteDance и Kling 3.0 от Kuaishou.

Почему это важно
Китайская видеомодель топ-уровня, заявляющая о соответствии закрытым конкурентам по качеству при более низкой цене и обязательстве открыть веса, усиливает конкурентную гонку в китайской генерации видео наряду с Kling и Seedance.
Справочно (7)

xAI выпускает голосовую модель Grok Voice Think Fast 2.0

xAI
аудио офиц. + СМИ 2 ист. ~1 мин

xAI выпустила Grok Voice Think Fast 2.0, сократив использование reasoning-токенов примерно на 60% и время до первого звука с 1.25 до 0.70 секунды по сравнению с версией 1.0, по цене $0.08/минуту. Псевдоним по умолчанию grok-voice-latest перейдёт на версию 2.0 5 августа.

Почему это важно
Заметное улучшение задержки и стоимости для голосового AI в реальном времени — направление, в котором xAI стремится конкурировать с голосовыми продуктами OpenAI и Google.

Meta повышает прогноз капзатрат на AI в 2026 году до $130-145 млрд на фоне обвала свободного денежного потока

Meta
индустрия офиц. + СМИ 2 ист. ~1 мин

Результаты Meta за второй квартал 2026 года показали выручку $60.8 млрд (+28% год к году), но свободный денежный поток сократился до $784 млн после $31.1 млрд капзатрат на AI-инфраструктуру; компания повысила годовой прогноз капзатрат до $130-145 млрд. Reality Labs потеряла $4.62 млрд за квартал.

Почему это важно
Подчёркивает масштаб капитала, который Meta направляет на AI-инфраструктуру, и компромисс с ближайшей прибыльностью, на который реагируют инвесторы.

Oracle расширяет партнёрство с Google Cloud, чтобы принести модели Gemini в корпоративные приложения

Google DeepMind
индустрия офиц. + СМИ 2 ист. ~1 мин

Oracle и Google Cloud расширили партнёрство, сделав Gemini 3.1 Flash-Lite и Gemini 3.5 Flash доступными внутри Oracle AI Agent Studio для Fusion Applications, а также встроив их в Oracle Fusion Cloud Applications и NetSuite.

Почему это важно
Расширяет корпоративное распространение Gemini через одного из крупнейших поставщиков бизнес-приложений — канал дистрибуции, которого у Google ранее не было в таком масштабе.

Сбер публикует обновлённую публичную модель угроз для AI-систем, охватывающую 37 угроз и 51 метод атак

Sber
индустрия только СМИ 3 ист. ~1 мин

Сбер выпустил обновлённую модель киберугроз для AI-систем на своём публичном портале «Кибрарий», описав 37 угроз и 51 метод их реализации на протяжении всего жизненного цикла AI, включая риски, специфичные для генеративных моделей, мультиагентных систем и RAG/LLM-адаптеров.

Почему это важно
Публикация крупным российским банком детальной, открытой таксономии угроз для генеративных и агентных AI-систем даёт локальным разработчикам AI и командам безопасности конкретный референс-фреймворк, отражая растущую формализацию практики AI-безопасности на российском рынке.

Codex CLI 0.146.0 добавляет именование сессий, манифесты плагинов и удалённое подключение через WebSocket

OpenAI
инструменты официальный 1 ист. ~1 мин

Codex CLI 0.146.0 (выпущен 2026-07-29) добавляет именование сессий через /new и /clear, закрепление тредов и постраничный форк тредов, поддержку манифестов Agent Plugins с совместимостью с Amazon Bedrock и маркетплейсом Claude Code, WebSocket-соединение между app-server и удалёнными хостами Code Mode, а также автономный веб-поиск для пользовательских провайдеров моделей.

Почему это важно
Совместимость манифестов плагинов с Claude Code и Bedrock сигнализирует о движении Codex CLI к общей экосистеме агентных плагинов, а не закрытому формату.

OpenCode v1.18.10 добавляет автоматическое обнаружение моделей Modal и исправления стабильности десктопа

SST
инструменты официальный 1 ист. ~1 мин

OpenCode v1.18.10 (выпущен 2026-07-30) добавляет автоматическое обнаружение доступных моделей Modal, предотвращает дублирование вложений в десктоп-приложении, улучшает стек уведомлений-тостов и исправляет баг, из-за которого повреждённые сохранённые вкладки сохраняли сломанное состояние вкладок между запусками.

Почему это важно
Продолжает быстрый еженедельный темп релизов OpenCode по мере расширения поддержки провайдеров (Modal) наряду с работой над надёжностью десктоп-приложения.

GitHub Copilot в Visual Studio добавляет превью агента на основе SDK и встроенное ревью кода

GitHub
инструменты официальный 1 ист. ~1 мин

Июльское обновление GitHub Copilot для Visual Studio за 2026 год (опубликовано 2026-07-30) представляет нового агента на основе Copilot SDK в публичном превью с меньшим числом взаимных обменов репликами, встроенные навыки по .NET и Azure от собственных команд Microsoft, встроенную функцию ревью кода 'Review Selection' и пользовательские инструкции на уровне организации для Copilot Business/Enterprise.

Почему это важно
Приносит в Visual Studio тот же Copilot SDK, что питает GitHub Copilot CLI, а также встроенную экспертизу по .NET/Azure прямо в набор инструментов агента.