Ежедневный дайджест
16 пунктов · ~16 мин · Неделя 2026-W39
Обязательно к прочтению (2)
Claude обнаружил новую ферментную систему с CRISPR-подобными повторами
AnthropicНовая лаборатория Anthropic по наукам о жизни сообщила, что агенты Claude, запущенные как ~950 параллельных агентов на протяжении 21 часа, сузили 200 000+ обратных транскриптаз до 20 кандидатов и выявили ранее неизвестную фаговую ферментную систему — array-associated reverse transcriptases (ART), чей массив повторов экспрессируется в виде отдельных коротких РНК. Учёные-люди подтвердили находку в экспериментах в «мокрой» лаборатории и опубликовали препринт; пионер CRISPR Фэн Чжан назвал её «по-настоящему интригующей».
The Tasteful Agent: измерение «вкуса» в задачах длинного горизонта
MicrosoftПредставлен Taste-Bench: вопросы на развилках решений, автоматически извлечённые из реальных траекторий агентов (параллельные попытки и обходы внутри траектории, без ручной разметки), — они измеряют, выбирает ли агент верную ветку до того, как увидит результат. Лучшая frontier-модель набирает лишь 59,7%; развилки с отложенными свидетельствами даются значительно труднее, а «вкус» улучшается дистилляцией оценки учителя, знающего исход, что поднимает end-to-end успех на held-out SWE-bench Pro.
Стоит знать (3)
Gemini 3.8 TTS: создание собственных голосов и синтез на 100+ языках
Google DeepMindGoogle выпустила Gemini 3.8 Flash TTS и Flash-Lite TTS (23 сентября) — самые выразительные на данный момент модели генерации аудио: создание голосов с нуля, репликация голоса по коротким сэмплам и построчное управление исполнением на 100+ языках. Защитные механизмы включают проверку согласия, водяные знаки SynthID и учётные данные C2PA.
Agensh: масштабирование организационного интеллекта до 1024 агентов
Microsoft ResearchДецентрализованный мультиагентный каркас без центрального оркестратора: исполнители сами забирают подзадачи и координируются через общее рабочее пространство, шину сообщений и общий контекст. Число агентов выступает новым измерением масштабирования — на сложнейших задачах ProgramBench с GPT-5.6-sol рост с 1 до 128 агентов поднимает средний pass rate с 19,31% до 28,78%, а задача pandoc — с 33,89% до 55,06% на 1024 агентах, причём по мере роста организации возникают самоорганизованные паттерны сотрудничества.
Cursor выпускает PR-ботов Rollouts и Security Review
Ченджлог Cursor от 23 сентября добавляет двух ботов для шиппинга кода на Teams и Enterprise: Rollouts пишет план мониторинга комментарием в PR, отслеживает здоровье деплоя (обнаружена регрессия / здоров / неопределённо) по логам, метрикам и трейсам и может уведомить, открыть revert-PR или передать в облачного агента — хотя сам он сегодня не мержит и не откатывает. Security Review оставляет один комментарий на PR об эксплуатируемых багах (инъекции, обходы авторизации, секреты, SSRF, десериализация, изменения зависимостей) с серьёзностью и путём атаки.
Справочно (11)
Google развивает Private AI Compute: защищённая серверная память
Google DeepMindКоманда Google Private AI Compute анонсировала (23 сентября) слой постоянной памяти, который хранит пользовательские данные в зашифрованном виде в облаке, а ключи расшифровки держатся только на устройстве пользователя — сам Google их прочитать не может. Решение использует secure enclaves и ключи, производные от устройства, публикует защищённый от подделки публичный отчёт о серверном ПО и проходит независимый аудит безопасности.
Эмерджентный сговор при долгогоризонтном взаимодействии LLM-агентов
Исследование коллузивного поведения, спонтанно возникающего в долгогоризонтных стратегических взаимодействиях между LLM-агентами, — значимый для safety режим отказа, который проявляется только когда агенты планируют и балансируют на многошаговом горизонте, а не в одноходовых играх.
Claude Code v2.1.281: guardrails для Bedrock, отключение атрибуции, исправления безопасности
Anthropicv2.1.281 (23 сентября) добавляет Bedrock STS assume_role и guardrails, блокировку desktop-политик в apps gateway, "attribution": false для скрытия атрибуции коммитов/PR, elicitation в MCP URL-режиме, рекомендацию auto-режима в /insights и исправления безопасности (рекурсивный rm из подстановки команд теперь запрашивает подтверждение).
OpenClaw прошёл аудит безопасности Trail of Bits: все находки устранены
Ревью Trail of Bits платформы OpenClaw — проведённое в рамках инициативы OpenAI «Patch the Planet» с помощью Codex — дало 27 приватных рекомендаций и 3 PR по харденингу: 24 проблемы с рейтингом серьёзности (0 Critical, 2 High, 16 Medium, 6 Low), 23 подтверждены, все исправлены в main и выпущены в 2026.8.1 и 2026.7.33 LTS. Ключевые темы: права должны переноситься на последующие работы и привязываться к конкретному файлу/действию, с проверкой в момент использования.
llama.cpp v0.5.0 stable: работа над CUDA/Metal-ядрами, video_url в server
llama.cpp пометил v0.5.0 (23 сентября): ускорение CUDA conv2d implicit-GEMM, фьюжн Metal MoE и SSM_CONV, привязка сервера к нескольким адресам, поддержка draft-моделей для Gemma4 DSpark, новые модели (MiMo-V2.6, Nemotron MTP/H, Qwen4Exp, HRM-Text/DFM Mimir 1B) и обновление ggml до 0.25.0. Сервер также получил стандартизованный OpenAI тип контента video_url и URI вида data:video/*.
Zed 1.21.0: BYOK для Opus 5.5 и GPT-6 Astra/Sol/Luna, вход через SuperGrok
Zed 1.21.0 (23 сентября) добавляет BYOK для Anthropic Opus 5.5 и OpenAI GPT-6 Astra, Sol и Luna, вход для подписчиков SuperGrok, поддержку DeepSeek Flash 4.1, agent.prevent_idle_sleep и более быстрый рендеринг кода-блоков. 1.22.0-pre добавляет переопределение модели на каждый вызов в spawn_agent, автоматическую компакцию сабагентов и динамическую загрузку списков моделей OpenCode Zen/Go.
Приложение GitHub Copilot получает локальную песочницу и OpenTelemetry
GitHubПосле добавленных на этой неделе моделей (Claude Opus 5.5, GPT-6 Sol/Luna, Grok 4.7) ченджлог GitHub Copilot добавляет локальную песочницу уровня Release для приложения Copilot (23 сентября) и поддержку OpenTelemetry (22 сентября), а также более быстрый code intelligence для C++ за счёт индексации всей кодовой базы и улучшения для JetBrains.
Ollama v0.34.4 pre-release: исправления флака model-not-found и структурированных выводов thinking-моделей
Ollama v0.34.4 (23 сентября, pre-release) исправляет периодические ошибки сервера «model not found», применяет структурированные выводы за один проход на thinking-моделях и обновляет llama.cpp и MLX: динамическое разрешение изображений Gemma 4 на MLX и более быстрая обработка промптов для Qwen 3.8.
Pydantic AI v2.48.0 подключает gpt-6-sol, gpt-6-luna и claude-opus-5-5
PydanticPydantic AI 2.48.0 (22 сентября) добавляет новые аудиомодели OpenAI с genai-prices 0.1.7/0.1.8 и сохраняет ID сообщений при load/dump для адаптеров Vercel AI (UIMessage.id) и AG-UI (Message.id); 2.47.0 (21 сентября) исправил обработку маршрута TypeSafeModel и пиклинг маршрута None.
Интеграции LangChain успевают за днём новых моделей
Релизы LangChain 21–23 сентября: langchain-core 1.6.4 (деприкация истории чат-сообщений), langchain-openai 1.6.3–1.6.5 (ограничения запросов GPT-6, инференс маршрутизации в Responses API, смена инструментов посреди диалога в SystemMessage), langchain-anthropic 1.7.3–1.7.4 (структурированный вывод автоматически маршрутизируется на json_schema для Fable и Opus 5.5), langchain-deepseek 1.1.1 (маппинг cache-read токенов), langchain-openrouter 0.2.9.
OpenAI убирает модели Sora 2 и Videos API из API
OpenAIМодели генерации видео Sora 2 и Videos API были удалены из API OpenAI 24 сентября 2026 года, завершив отключение, о котором разработчиков уведомили 24 марта 2026 года (приложение и веб-опыт закрыты 26 апреля). На странице деприкаций для семейства Sora 2 рекомендуемая модель-замена не указана.