Ежедневный дайджест

18 пунктов · ~18 мин · Неделя 2026-W39

Обязательно к прочтению (3)

Anthropic выпускает Claude Opus 5.5 по сниженным ценам

Anthropic
модели/LLM офиц. + СМИ 2 ист. ~1 мин

Anthropic выпустила Claude Opus 5.5 — свою сильнейшую на сегодняшний день модель, показывающую уровень Fable 5.1 на большинстве задач. Цена снижена до $4/$20 за миллион токенов, чтение кэша — до $0.20; Sonnet 5.5 и Haiku 5.5 обещаны в ближайшие недели. Модель несёт защиты уровня Fable и прошла внешнее тестирование METR и Frontier Design.

Почему это важно
Anthropic сжимает разрыв между лучшей и самой дешёвой frontier-моделями, срезав цены на 20–60%, за считаные часы до контрмеры OpenAI в виде более дешёвых тарифов GPT-6.

WorldCrafter: согласованная видео world-модель с неявной 3D-осведомлённой памятью

Tencent ARC Lab
исследования официальный 2 ист. ~1 мин

Видео world-модель с неявной 3D-осведомлённой памятью, адресуемой камерой: целевая точка обзора определяет, как исторические наблюдения сжимаются в бюджет токенов генератора, без явных depth-соответствий. Совместно обучаемый memory-энкодер плюс считывание с учётом позы и few-step-дистилляция поддерживают потоковое исследование сцены минутного масштаба из одного изображения или текстового промпта.

Почему это важно
Самая залайканная статья дня на HF Daily Papers (194 апвоута) и шаг к интерактивному исследованию открытых миров с long-horizon-согласованностью — главной блокирующей проблеме играбельных world-моделей.

GameHorizon Suite: данные и оценка мульти-горизонтного геймплея

Tencent ARC
исследования официальный 2 ист. ~1 мин

Набор оценки AI-геймплея по временным горизонтам: датасет 5 000 часов AAA-игр (21 игра, 100 профессиональных игроков) с выровненными по времени видео, действиями и мульти-горизонтными инструкциями, плюс офлайн-воспроизводимый бенчмарк и онлайн-трек, проверяющий, совпадает ли реальный геймплей с офлайн-оценками. 47 моделей оценены более чем миллионом вызовов.

Почему это важно
Второй результат по голосам на HF Daily Papers за день (126 апвоутов) — закрывает разрыв между узкими игровыми бенчмарками и long-horizon интерактивной игрой, где способности текущих моделей измеримо деградируют.

Стоит знать (8)

Suno v6 под вторым иском Universal/Sony; Suno подтверждает, что v6 обучена на пользовательских творениях

Suno
аудио только СМИ 4 ист. ~1 мин

Universal Music и Sony Music подали второй авторский иск против Suno — против моделей v6, выпущенных за несколько дней до этого, как «плода того же отравленного дерева», то есть, по утверждению истцов, обученных на тех же нарушающих права данных, что и модели из первого иска. Suno публично подтвердила, что v6 обучалась в том числе на материалах загрузок самих пользователей, назвала иск «принципиально порочным и по фактам, и по праву», а платные пользователи жалуются на падение качества относительно v5.

Почему это важно
Впервые модель музыкального AI, по которой заключена сделка с лейблом, сама стала предметом нового иска о нарушении прав — проверка того, защищают ли «лицензированные партнёрства» или, наоборот, вскрывают претензии к обучающим данным.

Tencent выкладывает в open source модели визуального поиска документов EVIE

Tencent
модели/LLM официальный 3 ист. ~1 мин

Tencent выпустила EVIE-8B и EVIE-4.5B — модели визуального поиска документов на базе Qwen3.5 с мульти-векторными эмбеддингами типа late-interaction (в духе ColBERT) поверх изображений страниц документов. EVIE-8B занимает 1-е место на ViDoRe V3 с 66.75 nDCG@10, EVIE-4.5B — 2-е с 66.02; обе доступны под Apache-2.0, код обучения и дистилляции — на GitHub. Student-модель 4.5B поддерживает усечение projection-головы с 2048D до 64D на инференсе, уменьшая размер индекса.

Почему это важно
Первые открытые модели, возглавившие лидерборд визуального поиска документов ViDoRe, — то есть действительно пригодный open document-RAG для корпоративных пайплайнов.

Intern-S2-397B: сильнейшая открытая научная мультимодальная модель Shanghai AI Lab

Shanghai AI Laboratory (InternLM)
модели/LLM официальный 2 ист. ~1 мин

Intern-S2-397B — самая мощная мультимодальная базовая модель Shanghai AI Lab для научного интеллекта и long-horizon-агентов: парадигма предобучения vision-language на сырых страницах научной литературы (без промежуточного парсинга в духе OCR) в сочетании с RL по 20+ научным доменам и black-box агентным RL в песочницах. Выпущена под Apache-2.0; точные бенчмарк-цифры опубликованы растровыми графиками, а не читаемым текстом.

Почему это важно
Продвигает open-source модели с научной специализацией по оси, отдельной от общих чат-ботов: дизайн биомолекулярных взаимодействий, генерация структур материалов и long-horizon агентные задачи.

OpenAI запускает GPT-6 Sol и Luna со снижением цены API на 50%

OpenAI
модели/LLM только СМИ 2 ист. ~1 мин

OpenAI выпустила GPT-6 Sol для сложных задач вроде кодинга и GPT-6 Luna для массовой суммаризации и извлечения данных; цена API — примерно вдвое ниже моделей серии 5.6. Компания заявляет, что Sol допускает вдвое меньше ошибок, чем предшественник, и достигает надёжности уровня Astra при заметно меньшей стоимости. Развёртывание охватывает ChatGPT Work, Codex и API; Luna также появится в desktop- и бесплатных тарифах.

Почему это важно
Обвал цен в среднем сегменте OpenAI случился через считаные часы после снижения цен на Opus 5.5 у Anthropic — признак обострения frontier-ценовой войны.

RRSI: регуляризованное рекурсивное самоулучшение агентных каркасов

Google Research
исследования официальный 3 ист. ~1 мин

Самоулучшение каркаса (автоэволюция промптов, управляющей логики и инструментария вокруг замороженной модели) регулярно переобучается под тренировочные задачи. RRSI добавляет регуляризацию: временно отжигаемый бюджет правок для proposer'а, а также селектор с критиком, отфильтровывающим привязанные к бенчмарку предложения, и прунером, отбрасывающим малополезные изменения.

Почему это важно
До +4.7 пункта на out-of-distribution-бенчмарках и на 30% меньше policy-токенов — самоулучшающиеся агентные каркасы способны обобщать, а не просто запоминать сплит эволюции.

Codex CLI 0.156.0: полноэкранный TUI, голосовой режим и дашборд использования

OpenAI
инструменты официальный 1 ист. ~1 мин

OpenAI выпустила rust-v0.156.0 Codex 22 сентября с опциональным полноэкранным UI через /tui (поиск по транскрипту, выделение мышью), голосовыми разговорами, включёнными по умолчанию (переключение F8), дашбордом аналитики /usage, worktree-сессиями по умолчанию и инлайн-рендерингом Mermaid/формул. Релиз также закрыл дыры в изоляции песочницы на Windows (входящие соединения) и привилегированных сокетах Linux/macOS и встроил OpenSSL 3.6.4. Alpha-поезд 0.157.0-alpha.2 — alpha.10 вышел 21–22 сентября.

Почему это важно
Полноэкранный поиск по транскрипту и аналитика использования делают Codex заметно удобнее как повседневного терминального агента.

Claude Code v2.1.280: Claude Opus 5.5 как модель Opus по умолчанию, фикс записи мимо дерева через симлинки

Anthropic
инструменты официальный 2 ист. ~1 мин

Claude Code v2.1.280 (22 сентября) добавляет claude-opus-5-5 как новую модель Opus по умолчанию — контекст 1M, $4/$20 за Mtok, чтение кэша $0.20. Связанные с безопасностью фиксы: acceptEdits/allow-правила/auto-режим больше не одобряют запись вне дерева через пути с симлинками, а auto-режим перестал бесконечно ретраить действия, отклонённые проверками безопасности. Также добавлены переменная окружения CLAUDE_CODE_MAX_MCP_DESCRIPTION_LENGTH и поддержка мыши в полноэкранном режиме.

Почему это важно
Фикс записи через симлинки закрывает реальный побег из песочницы, а снижение цен делает агентов класса Opus для кодинга заметно дешевле за токен.

Runway показывает генерацию видео в реальном времени: поток стримится по мере описания

Runway
видео офиц. + СМИ 2 ист. ~1 мин

Runway опубликовала исследование («Towards Instant Video Generation») о причинной (causal) генерации видео кадр за кадром, чтобы пользователь мог рулить потоком прямо в процессе описания, а не задавать промпт и ждать; модель обучается на собственных неидеальных выводах, чтобы малые ошибки не накапливались на длинных продолжениях. Работа строится на GWM-1/Gen-4.5; по словам Runway, генерация в реальном времени снижает GPU-стоимость на выход, но сроков продуктового релиза не объявлено.

Почему это важно
Управляемое в рантайме кадрирование двигает AI-видео от клипов «промпт-и-жди» к живым интерактивным медиа и улучшает юнит-экономику сервинга видео.
Справочно (7)

Qwen-Image-2.1 получил компаньона для улучшения промптов

Alibaba (Qwen)
изображения официальный 3 ист. ~1 мин

Qwen выпустила Qwen-Image-2.1-PE-T2I и Qwen-Image-2.1-PE-I2I — специализированные адаптеры-улучшители промптов для пайплайна T2I/редактирования Qwen-Image-2.1: дообученная Qwen3.5-VL 9B переписывает короткий промпт пользователя в детальный английский промпт плюс рекомендованное соотношение сторон, вывод в JSON. Только текстовый вывод, лицензия Qwen Research License; страница HF API при загрузке вернулась пустой, поэтому саммари основано на метаданных модели, а не полной карточке.

Почему это важно
Продолжает достраивать открытый стек Qwen для генерации изображений: компаньон-улучшитель промптов, для которого раньше понадобился бы отдельный закрытый инструмент.

ЮKassa выпустила MCP-сервер, позволяющий AI-агентам принимать платежи

Sber (YooKassa)
инструменты офиц. + СМИ 3 ист. ~1 мин

ЮKassa — платформа платежей, входящая в Сбербанк, — запустила MCP-сервер, позволяющий AI-агентам напрямую подключаться к её платёжной инфраструктуре: создавать счета, выдавать платёжные ссылки и проверять статусы платежей и возвратов прямо из чата. Онлайн-мерчанты могут принимать платежи через агентные сценарии без заказной интеграции.

Почему это важно
Один из первых продакшен-платёжных контуров, подключённых к экосистеме агентного AI в России.

vLLM v0.30.0 опубликован: DeepSeek-V4.1-Flash с FlashMLA KV в MXFP8 на Blackwell

vLLM project
инструменты официальный 1 ист. ~1 мин

Продолжение вчерашней истории с тегом без релиза: vLLM выпустил v0.30.0 22 сентября — 762 коммита от 315 контрибьюторов (104 новых). Главное: поддержка DeepSeek-V4.1-Flash со всем KV-кэшем в MXFP8 через FlashMLA V4.1 на SM100, плюс другие новые модели.

Почему это важно
Поддержка новой Flash-модели DeepSeek за день, с оптимизированным под SM100 attention-путём, делает её сразу пригодной для масштабного сервинга на GPU Blackwell.

GitHub Copilot получил Claude Opus 5.5, GPT-6 Sol и Luna, а также Grok 4.7

GitHub
инструменты официальный 1 ист. ~1 мин

Changelog GitHub (21–22 сентября) фиксирует доступность в Copilot моделей Claude Opus 5.5, OpenAI GPT-6 Sol и GPT-6 Luna, а также Grok 4.7 — три frontier-модели за два дня. Отдельные записи касаются улучшений Copilot для JetBrains и ускорения анализа кода C++ за счёт индексации всей кодовой базы.

Почему это важно
Выбор моделей внутри Copilot теперь одновременно охватывает флагманы Anthropic, OpenAI и xAI, ускоряя мульти-вендорную разнотипность в корпоративных IDE.

Cline v4.1.20 выполняет tool-вызовы сабагентов одного шага параллельно

Cline
инструменты официальный 1 ист. ~1 мин

Cline выпустил v4.1.20 22 сентября: сабагенты, порождённые в одном шаге, теперь выполняют tool-вызовы конкурентно, а не последовательно, сокращая wall-clock-время fan-out-задач. Два SDK-релиза того же дня — sdk/v0.0.84 и sdk/v0.0.85 — добавляют ретрай на запусках, упирающихся в лимит выходных токенов без пригодного tool-вызова, и дедуплицируют конкурентные опросы feature-флагов.

Почему это важно
Параллельное исполнение сабагентов убирает штраф по латентности агентной декомпозиции — паттерн, к которому сходятся и другие агентные каркасы.

Pydantic AI v2.47.0 и v2.46.0: совместимость и доработки TypeSafeModel

Pydantic
инструменты официальный 1 ист. ~1 мин

Pydantic AI выпустил v2.47.0 22 сентября (с заметкой о совместимости по именованию None-вывода) и v2.46.0 19 сентября, расширяющую TypeSafeModel на заполнение типизированных полей, — продолжение линейки TypeSafeModel, начатой в v2.45.0.

Почему это важно
Усиление TypeSafeModel — сигнал, что типизация структурированного вывода становится контрактом первого класса в агентных фреймворках.

Adobe Premiere (бесплатный, на Firefly) — мобильный редактор вышел на Android

Adobe
видео офиц. + СМИ 3 ист. ~1 мин

Adobe выпустила мобильный видеоредактор Premiere на Android (22 сентября): бесплатно, с многослойным монтажом, шаблонами YouTube и генеративными инструментами Firefly, почти через год после версии для iOS; он заменяет Premiere Rush, поддержка которого заканчивается 30 сентября. Пресса отмечает рамку «бесплатно, но с подвохом» и высокие требования к RAM, позиционируя продукт против Instagram Edits и CapCut.

Почему это важно
Ставит полноценный профессиональный редактор с Firefly в карман пользователя на крупнейшей мобильной ОС, давя на монополию ByteDance в мобильном казуальном монтаже.