Ежедневный дайджест
23 пункта · ~23 мин · Неделя 2026-W36
Обязательно к прочтению (1)
Anthropic выпустила Claude Fable 5.1 и Claude Mythos 5.1
Anthropic1 сентября Anthropic выпустила Claude Fable 5.1 (claude-fable-5-1 в API, AWS, Google Cloud, Azure) и её двойника с ослабленными защитными механизмами Mythos 5.1, доступного только проверенным американским программам киберзащиты и проектам в области биотеха. Бенчмарки: 55,8% в Terminal-Bench 4.0 (60,9% у Mythos) и 73,4% в CursorBench 3.2.0; цены прежние — $10/$50 за млн токенов, при этом чтение кэша подешевело на 75%, до $0,25/М, что делает типовые нагрузки примерно на 25% дешевле, чем Fable 5.
Стоит знать (9)
Jason Isbell и David Lowery подали коллективный иск к Suno из-за идентичности артистов
Suno1 сентября Jason Isbell, David Lowery и другие музыканты подали коллективный иск к Suno, обвиняя её в индексировании и воспроизведении идентичности артистов — голосов и сценических образов — без согласия. Иск примечателен тем, что строится на правах на публичность и идентичность, а не на авторском праве — новая юридическая теория против AI-генераторов музыки.
Meta Superintelligence Labs выпустила Muse Voice Transcribe — модель распознавания речи в реальном времени
MetaАнонсированная 1 сентября Muse Voice Transcribe — первая модель аудиовосприятия реального времени от Meta Superintelligence Labs: потоковый speech-to-text с нативной диаризацией говорящих и определением концовки фраз в единой модели, выдерживающий часовые сессии с 20+ говорящими, 70+ языками (25 валидировано на запуске) и переключением языков посреди предложения, с адаптивной задержкой на токен. Модель питает диктовку в Mac-приложении Meta AI и доступна через Model API Meta по $3 за 1000 аудиоминут.
Google запустила Pics — редактор изображений на базе Nano Banana для Workspace
Google1 сентября Google анонсировала Pics — инструмент создания и редактирования изображений на базе модели Nano Banana, уже доступный в Docs и Slides (Drive в ближайшие недели) и на pics.new. Он добавляет сегментацию объектов, редактирование и перевод текста внутри изображения без разрушения дизайна, несколько генераций на промпт и совместное редактирование в реальном времени. Развёртывание в ближайшие недели для подписчиков Google AI Pro и Ultra и большинства бизнес-клиентов Workspace.
OpenAI: Astra — первая модель, достигшая уровня Critical по кибербезопасности
OpenAIВ посте о безопасности от 1 сентября OpenAI сообщает, что Astra — первая из её моделей, достигшая порога критических возможностей в кибербезопасности (Critical) по её Preparedness Framework, и описывает усиленные защитные меры, применённые при выпуске. Пост сигнализирует о качественном скачке возможностей в наступательной кибероперациях накануне развёртывания Astra.
StudentSim: обучение симуляторов студентов на базе LLM
Microsoft ResearchФреймворк обучения, превращающий разреженные данные по отдельным студентам в индивидуализированные LLM-симуляторы студентов через объединённое обучение плюс специализацию под каждого студента, чтобы симулятор и воспроизводил ответы студента, и развивался под руководством тьютора. В комплекте StudentSimEval — протокол оценки на 60 студентах по шахматам, ESL-письму и математике на публичных датасетах учащихся.
Anthropic запустила Enterprise Frontier Safeguards для клиентов из регулируемых отраслей
Anthropic1 сентября Anthropic анонсировала Enterprise Frontier Safeguards: нулевое хранение данных (zero-data-retention) в сочетании с автоматическим выявлением злоупотреблений, данные мониторинга которого остаются в облачном хранилище, контролируемом заказчиком, под его ключами и без участия людей со стороны Anthropic. Продукт создан вместе со 100+ предприятиями, включая Goldman Sachs, Mastercard, Visa и Stripe; бесплатно, поэтапный запуск с этой осени в Claude Code, Claude Enterprise, Bedrock и Microsoft Foundry.
ChatGPT теперь может подключаться к EHR и медицинским источникам данных
OpenAI1 сентября OpenAI объявила, что медицинские организации могут подключать электронные медицинские карты и другие доверенные отраслевые данные к ChatGPT, позволяя клиницистам безопасно подтягивать контекст пациента и медицинские исследования в ассистента.
Google DeepMind добавила агентное понимание видео в Gemini
Google DeepMind1 сентября Google запустила агентное понимание видео для Gemini 3.7/3.6 Flash и 3.5 Flash-Lite через Gemini API: вместо сэмплирования с фиксированной частотой 1 FPS модель сама решает, что смотреть, с какой скоростью и через какую модальность. Google сообщает о снижении расхода токенов до 88%, стоимости анализа — на 66% и росте точности на 7%; функция уже доступна в AI Studio и Gemini Enterprise Agent Platform по стандартным тарифам на токены, а «Ask YouTube» появится следом.
Claude Code 2.1.257/2.1.258: Fable 5.1 по умолчанию, усиление защиты от побега из изоляции
AnthropicПосле v2.1.252 (31 августа) Claude Code v2.1.257 (1 сентября) сделала Claude Fable 5.1 моделью по умолчанию (1M контекста, $10/$50 за млн токенов), добавила настройки timeFormat/timeZone, CLAUDE_CODE_SUBAGENT_MODEL_FORCE и правило для auto-режима, прекращающее автопоказ интернет-запросов облачных учётных данных и обход сетевых ограничений; также исправлены побеги путей плагинов через симлинки и обход permissions.ask через составные команды. v2.1.258 (1 сентября) починила регрессию запуска на macOS 12 из 2.1.255 и сбои удалённых сессий после повторной отправки подтверждений разрешений.
Справочно (13)
Suno снова судятся — за обучение на каталоге региональной мексиканской музыки ради испаноязычных AI-песен
SunoИск, поданный примерно 31 августа — 1 сентября адвокатом из дела «Blurred Lines» Richard Busch по поручению лейбла региональной мексиканской музыки Gerencia 360, обвиняет Suno (и вендора данных Bright Data) в обучении на мексиканском музыкальном каталоге для производства испаноязычных AI-песен. Это как минимум третий иск о обучении на данных против Suno за этот год после исков мейджор-лейблов и GEMA.
Udio ответил на иск Sony Music: обучение — «классический fair use», ущерб — «$200 за произведение»
UdioВ судебном документе, опубликованном 1 сентября, Udio удвоил защиту против увеличенного копирайт-иска Sony Music, назвав своё AI-обучение «классическим fair use» и заявив, что даже при доказанном нарушении законные убытки должны быть «не выше $200 за произведение». В документе также признаётся, что Udio получал часть обучающих данных с помощью YT-DLP — инструмента для скрейпинга YouTube.
Агентная image-модель Meta Muse Image стала доступна разработчикам на fal
Meta1 сентября Muse Image от Meta Superintelligence Labs — агентная модель с архитектурой «планировщик + диффузор», которая ищет референсы в интернете, пишет и запускает код для точных элементов и сама ревьюит результат — стала доступна разработчикам и предприятиям на fal через эндпоинты meta/muse-image/text-to-image и meta/muse-image/edit, с допуском к коммерческому использованию по $0,01 за изображение. Meta сообщает, что модель входит в топ-5 Arena по text-to-image и одно- и мультиизображечному редактированию, с качеством, растущим вместе с test-time compute.
SMELT: зацикленные MoE-трансформеры догоняют базовое масштабирование при равных вычислениях
ByteDance SeedОпубликованная 1 сентября (arXiv 2609.01343) работа авторов ByteDance Seed исследует зацикливание слоёв в разреженных MoE-трансформерах при строгом совпадении FLOPs на токен, не-эмбеддинговых параметров и KV-кэша с незацикленным бейзлайном. Полученный рецепт, SMELT, удваивает среднюю половину слоёв и масштабировался на четырёх размерах до 54B не-эмбеддинговых параметров с подгонкой Chinchilla-подобного закона масштабирования под каждую архитектуру; он экономит 6,8–18% обучающих FLOPs на compute-оптимальном фронте, а механистический анализ показывает, что второй проход цикла уменьшает attention-sink массу и перенаправляет её на содержательно значимые токены.
Команда Qwen опубликовала Qwen-Drive-1.0 — визуально-языковую фундаментальную модель для автономного вождения
AlibabaОпубликовано 31 августа (arXiv 2609.00111) авторами Qwen/Alibaba и HUST: Qwen-Drive-1.0 расширяет предобученный VLM-бэкбон перцепционной головой в bird's-eye-view с совместным 3D-детектированием, семантической оккупантностью и сегментацией карты, плюс Planning Expert, генерирующий траектории эго. Поэтапная схема обучения смешивает драйвинговую супервизию с общими визуально-языковыми данными; оценки охватывают open-loop, псевдо-closed-loop и closed-loop режимы. Веса пока не выпущены; статья вошла в Hugging Face Daily Papers 2 сентября.
xAI опубликовала оценку биобезопасности Grok 4.6 от LatchBio
xAI1 сентября xAI опубликовала «Biosecurity at the frontier» — отчёт о тестировании Grok 4.6 независимым оценщиком LatchBio на задачи мониторинга биобезопасности и состязательные биологические сценарии; сопутствующий анализ LatchBio называет Grok 4.6 фронтирной биологической моделью на 1 716 оценённых траекториях.
LoopArena: бенчмаркинг моделей как рантайм-контроллеров для loop engineering
Бенчмарк для оценки модели-контроллера, которая ведёт отдельного фиксированного кодинг-агента-воркера через длительные задачи: после каждого раунда кодинга она читает структурированную сводку прогона и решает, что делать дальше, верифицировать или остановиться. Разделяет способность к управлению циклом от сырых кодинг-способностей воркера в трёх настройках охвата исполнения.
OpenCode v1.18.26 терпит устаревшие thinking-блоки Claude 5
OpenCode v1.18.26 (1 сентября) делает сессии Claude 5 устойчивыми к устаревшим thinking-блокам вместо падения после смены промпта или инструмента, позволяет Bedrock GPT-5.6 принимать reasoning effort `none`, улучшает обработку reasoning/replay и тайминги tool-вызовов в Bedrock и запрашивает имя Azure-ресурса напрямую при входе через Azure CLI. Предыдущий релиз v1.18.24-25 (28 августа) добавил аутентификацию Microsoft Entra ID через Azure CLI.
OpenClaw 2026.8.2: домашний док агента, Linux-приложение для десктопа, фоновые сессии
После 2026.8.1 (31 августа: поиск по разговорам и удалённые сессии на сопряжённых устройствах или облачных воркерах с переиспользуемыми прогретыми машинами) OpenClaw 2026.8.2 (1 сентября) добавил Home agent dock (Cmd/Ctrl+Shift+H), официальные Linux-сборки .deb/AppImage с подписанными обновлениями, фоновые сессии и обновление Sharp до 0.35.4 с закрытием CVE декодирования изображений. Оба релиза опубликованы автором Peter Steinberger.
Доступ к моделям Copilot теперь определяется только организацией, платящей по счёту
GitHubС 31 августа пользователи Copilot из нескольких организаций получают доступ к моделям, определяемый только организацией, оплачивающей их использование (поле «Usage billed to»), вместо прежнего правила, по которому доступ давала любая организация, включившая модель. В тот же день в changelog также отключён ряд моделей Copilot. Пользователи, чей доступ целиком идёт через enterprise, изменений не заметят.
Cline v4.1.17 импортирует историю Claude Code, Codex и opencode в один клик
2 сентября Cline выпустила v4.1.17, Desktop v0.0.22, CLI v3.0.61 и SDK v0.0.82. Desktop добавляет импорт в один клик истории Claude Code, Codex и opencode в возобновляемые сессии Cline, плюс голосовой ввод на macOS; в SDK появился SessionImportService и исправлено молчаливое отключение tool calling на моделях Dify, SAP AI Core, opencode и Codex CLI. Обновление каталога моделей добавило 10 провайдеров и изменило разрешённый дефолт для 57 из них — Anthropic теперь по умолчанию Claude Fable 5.1 вместо Opus 5; Windows-бинарники CLI подписаны Authenticode.
Альфы LangChain 1.4.0 строят first-party MCP-адаптер
LangChain 1.4.0a3 (1 сентября) и a4 (2 сентября) расширяют новое пространство имён langchain.mcp: list_tools с кэшированием через cache_mode (SEP-2549), переименование конвертации инструментов в as_langchain_tool, метаданные инструментов, сгруппированные под пространством mcp, и обязательный fastmcp>=4.0.0 (a4 чинит совместимость с 4.0.1 и привязывает маршрутизацию прерываний к согласованной эпохе протокола). Серия альф (a1-a2, 27–28 августа) представила MCPAdapter, превращающий любой MCP-сервер в инструменты LangChain с мультисерверной аутентификацией, согласованием эпохи протокола и elicitation через LangGraph interrupts — портируя и заменяя собой langchain-mcp-adapters.
Волна llama.cpp за 1–2 сентября: +4,9% к генерации от фикса n-gram-поиска, слитый CUDA-редукшн для MoE
ggmlВ b10739-b10753 (1–2 сентября) llama.cpp получила фикс n-gram-поиска по KV-кэшу, использующий индекс позиции в последовательности — генерация текста на одной модели Qwen3 выросла с 69,3 до 72,7 tok/s (+4,9%) при контексте 71k (b10750) — плюс слитый CUDA-кернел взвешенной экспертной редукции для MoE с k=2..15 экспертами, снижающий трафик глобальной памяти (b10751). Остальное — работа над Metal: настройка fa-vec для M2 Pro, M2 Max и A18 Pro, фиксы утечек autoreleasepool и поддержка сборки metallib в xcframework (b10752).