Ежедневный дайджест
18 пунктов · ~18 мин · Неделя 2026-W39
Обязательно к прочтению (3)
Anthropic выпускает Claude Opus 5.5 по сниженным ценам
AnthropicAnthropic выпустила Claude Opus 5.5 — свою сильнейшую на сегодняшний день модель, показывающую уровень Fable 5.1 на большинстве задач. Цена снижена до $4/$20 за миллион токенов, чтение кэша — до $0.20; Sonnet 5.5 и Haiku 5.5 обещаны в ближайшие недели. Модель несёт защиты уровня Fable и прошла внешнее тестирование METR и Frontier Design.
WorldCrafter: согласованная видео world-модель с неявной 3D-осведомлённой памятью
Tencent ARC LabВидео world-модель с неявной 3D-осведомлённой памятью, адресуемой камерой: целевая точка обзора определяет, как исторические наблюдения сжимаются в бюджет токенов генератора, без явных depth-соответствий. Совместно обучаемый memory-энкодер плюс считывание с учётом позы и few-step-дистилляция поддерживают потоковое исследование сцены минутного масштаба из одного изображения или текстового промпта.
GameHorizon Suite: данные и оценка мульти-горизонтного геймплея
Tencent ARCНабор оценки AI-геймплея по временным горизонтам: датасет 5 000 часов AAA-игр (21 игра, 100 профессиональных игроков) с выровненными по времени видео, действиями и мульти-горизонтными инструкциями, плюс офлайн-воспроизводимый бенчмарк и онлайн-трек, проверяющий, совпадает ли реальный геймплей с офлайн-оценками. 47 моделей оценены более чем миллионом вызовов.
Стоит знать (8)
Suno v6 под вторым иском Universal/Sony; Suno подтверждает, что v6 обучена на пользовательских творениях
SunoUniversal Music и Sony Music подали второй авторский иск против Suno — против моделей v6, выпущенных за несколько дней до этого, как «плода того же отравленного дерева», то есть, по утверждению истцов, обученных на тех же нарушающих права данных, что и модели из первого иска. Suno публично подтвердила, что v6 обучалась в том числе на материалах загрузок самих пользователей, назвала иск «принципиально порочным и по фактам, и по праву», а платные пользователи жалуются на падение качества относительно v5.
Tencent выкладывает в open source модели визуального поиска документов EVIE
TencentTencent выпустила EVIE-8B и EVIE-4.5B — модели визуального поиска документов на базе Qwen3.5 с мульти-векторными эмбеддингами типа late-interaction (в духе ColBERT) поверх изображений страниц документов. EVIE-8B занимает 1-е место на ViDoRe V3 с 66.75 nDCG@10, EVIE-4.5B — 2-е с 66.02; обе доступны под Apache-2.0, код обучения и дистилляции — на GitHub. Student-модель 4.5B поддерживает усечение projection-головы с 2048D до 64D на инференсе, уменьшая размер индекса.
Intern-S2-397B: сильнейшая открытая научная мультимодальная модель Shanghai AI Lab
Shanghai AI Laboratory (InternLM)Intern-S2-397B — самая мощная мультимодальная базовая модель Shanghai AI Lab для научного интеллекта и long-horizon-агентов: парадигма предобучения vision-language на сырых страницах научной литературы (без промежуточного парсинга в духе OCR) в сочетании с RL по 20+ научным доменам и black-box агентным RL в песочницах. Выпущена под Apache-2.0; точные бенчмарк-цифры опубликованы растровыми графиками, а не читаемым текстом.
OpenAI запускает GPT-6 Sol и Luna со снижением цены API на 50%
OpenAIOpenAI выпустила GPT-6 Sol для сложных задач вроде кодинга и GPT-6 Luna для массовой суммаризации и извлечения данных; цена API — примерно вдвое ниже моделей серии 5.6. Компания заявляет, что Sol допускает вдвое меньше ошибок, чем предшественник, и достигает надёжности уровня Astra при заметно меньшей стоимости. Развёртывание охватывает ChatGPT Work, Codex и API; Luna также появится в desktop- и бесплатных тарифах.
RRSI: регуляризованное рекурсивное самоулучшение агентных каркасов
Google ResearchСамоулучшение каркаса (автоэволюция промптов, управляющей логики и инструментария вокруг замороженной модели) регулярно переобучается под тренировочные задачи. RRSI добавляет регуляризацию: временно отжигаемый бюджет правок для proposer'а, а также селектор с критиком, отфильтровывающим привязанные к бенчмарку предложения, и прунером, отбрасывающим малополезные изменения.
Codex CLI 0.156.0: полноэкранный TUI, голосовой режим и дашборд использования
OpenAIOpenAI выпустила rust-v0.156.0 Codex 22 сентября с опциональным полноэкранным UI через /tui (поиск по транскрипту, выделение мышью), голосовыми разговорами, включёнными по умолчанию (переключение F8), дашбордом аналитики /usage, worktree-сессиями по умолчанию и инлайн-рендерингом Mermaid/формул. Релиз также закрыл дыры в изоляции песочницы на Windows (входящие соединения) и привилегированных сокетах Linux/macOS и встроил OpenSSL 3.6.4. Alpha-поезд 0.157.0-alpha.2 — alpha.10 вышел 21–22 сентября.
Claude Code v2.1.280: Claude Opus 5.5 как модель Opus по умолчанию, фикс записи мимо дерева через симлинки
AnthropicClaude Code v2.1.280 (22 сентября) добавляет claude-opus-5-5 как новую модель Opus по умолчанию — контекст 1M, $4/$20 за Mtok, чтение кэша $0.20. Связанные с безопасностью фиксы: acceptEdits/allow-правила/auto-режим больше не одобряют запись вне дерева через пути с симлинками, а auto-режим перестал бесконечно ретраить действия, отклонённые проверками безопасности. Также добавлены переменная окружения CLAUDE_CODE_MAX_MCP_DESCRIPTION_LENGTH и поддержка мыши в полноэкранном режиме.
Runway показывает генерацию видео в реальном времени: поток стримится по мере описания
RunwayRunway опубликовала исследование («Towards Instant Video Generation») о причинной (causal) генерации видео кадр за кадром, чтобы пользователь мог рулить потоком прямо в процессе описания, а не задавать промпт и ждать; модель обучается на собственных неидеальных выводах, чтобы малые ошибки не накапливались на длинных продолжениях. Работа строится на GWM-1/Gen-4.5; по словам Runway, генерация в реальном времени снижает GPU-стоимость на выход, но сроков продуктового релиза не объявлено.
Справочно (7)
Qwen-Image-2.1 получил компаньона для улучшения промптов
Alibaba (Qwen)Qwen выпустила Qwen-Image-2.1-PE-T2I и Qwen-Image-2.1-PE-I2I — специализированные адаптеры-улучшители промптов для пайплайна T2I/редактирования Qwen-Image-2.1: дообученная Qwen3.5-VL 9B переписывает короткий промпт пользователя в детальный английский промпт плюс рекомендованное соотношение сторон, вывод в JSON. Только текстовый вывод, лицензия Qwen Research License; страница HF API при загрузке вернулась пустой, поэтому саммари основано на метаданных модели, а не полной карточке.
ЮKassa выпустила MCP-сервер, позволяющий AI-агентам принимать платежи
Sber (YooKassa)ЮKassa — платформа платежей, входящая в Сбербанк, — запустила MCP-сервер, позволяющий AI-агентам напрямую подключаться к её платёжной инфраструктуре: создавать счета, выдавать платёжные ссылки и проверять статусы платежей и возвратов прямо из чата. Онлайн-мерчанты могут принимать платежи через агентные сценарии без заказной интеграции.
vLLM v0.30.0 опубликован: DeepSeek-V4.1-Flash с FlashMLA KV в MXFP8 на Blackwell
vLLM projectПродолжение вчерашней истории с тегом без релиза: vLLM выпустил v0.30.0 22 сентября — 762 коммита от 315 контрибьюторов (104 новых). Главное: поддержка DeepSeek-V4.1-Flash со всем KV-кэшем в MXFP8 через FlashMLA V4.1 на SM100, плюс другие новые модели.
GitHub Copilot получил Claude Opus 5.5, GPT-6 Sol и Luna, а также Grok 4.7
GitHubChangelog GitHub (21–22 сентября) фиксирует доступность в Copilot моделей Claude Opus 5.5, OpenAI GPT-6 Sol и GPT-6 Luna, а также Grok 4.7 — три frontier-модели за два дня. Отдельные записи касаются улучшений Copilot для JetBrains и ускорения анализа кода C++ за счёт индексации всей кодовой базы.
Cline v4.1.20 выполняет tool-вызовы сабагентов одного шага параллельно
ClineCline выпустил v4.1.20 22 сентября: сабагенты, порождённые в одном шаге, теперь выполняют tool-вызовы конкурентно, а не последовательно, сокращая wall-clock-время fan-out-задач. Два SDK-релиза того же дня — sdk/v0.0.84 и sdk/v0.0.85 — добавляют ретрай на запусках, упирающихся в лимит выходных токенов без пригодного tool-вызова, и дедуплицируют конкурентные опросы feature-флагов.
Pydantic AI v2.47.0 и v2.46.0: совместимость и доработки TypeSafeModel
PydanticPydantic AI выпустил v2.47.0 22 сентября (с заметкой о совместимости по именованию None-вывода) и v2.46.0 19 сентября, расширяющую TypeSafeModel на заполнение типизированных полей, — продолжение линейки TypeSafeModel, начатой в v2.45.0.
Adobe Premiere (бесплатный, на Firefly) — мобильный редактор вышел на Android
AdobeAdobe выпустила мобильный видеоредактор Premiere на Android (22 сентября): бесплатно, с многослойным монтажом, шаблонами YouTube и генеративными инструментами Firefly, почти через год после версии для iOS; он заменяет Premiere Rush, поддержка которого заканчивается 30 сентября. Пресса отмечает рамку «бесплатно, но с подвохом» и высокие требования к RAM, позиционируя продукт против Instagram Edits и CapCut.