Ежедневный дайджест

12 пунктов · ~12 мин · Неделя 2026-W38

Обязательно к прочтению (5)

Google представила речевые модели Gemini 3.8 Live и 3.8 Live Extended Thinking

Google DeepMind
модели/LLM офиц. + СМИ 2 ист. ~1 мин

Google представила Gemini 3.8 Live и 3.8 Live Extended Thinking — свои самые продвинутые модели живого диалога: околореальное время реакции на визуальный контекст, фоновое выполнение инструментов и автоматическое переключение языка между 97 языками. Extended Thinking рассуждает и говорит одновременно, заполняя паузы словами, возглавляет Speech-to-Speech Quality Index с результатом 82,6 и набирает 97,7% на Big Bench Audio. Модели становятся доступны в Gemini API, AI Studio, Workspace, Search Live и приложении Gemini; весь сгенерированный звук несёт водяной знак SynthID.

Почему это важно
Речевой режим «речь-в-речь» с одновременным рассуждением переводит голосовых агентов от компромиссов со скриптами и задержками к единой модели, способной думать вслух, — прямая конкуренция со стеком Realtime API от OpenAI.

Atria Dawn: превью агентов-ориентированной MoE-модели на 744B от Shanghai AI Laboratory

Shanghai AI Laboratory
исследования офиц. + СМИ 3 ист. ~1 мин

Превью агентной фундаментальной MoE-модели на 744B, обученной с Verifiable Experience Pipeline, которая закрепляет траектории агента в исполнимых средах с проверяемыми результатами. Конкурирует с фронтир-агентами на 16 бенчмарках, лидируя на 5. Статья также анализирует собственную разработку: 769 записей задач от 56 участников, около трети задач с помощью ИИ оценены как невыполнимые без ИИ.

Почему это важно
369 апвоутов на HF Daily Papers; одно из самых полных описаний совместного рабочего процесса человека и ИИ в масштабе фундаментальной модели, с открытым превью-релизом на GitHub.

Vidu S2: realtime-интерактивная, редактируемая и пространственная видеогенерация

ShengShu Intelligence
исследования официальный 2 ист. ~1 мин

Две модели — интерактивная аватарная модель и модель видеомонтажа в реальном времени — генерируют и переоформляют видеопотоки 720p на лету, с динамически обновляемыми референсами и исследованием пространственной (3D) генерации. Новое здесь — переход видеогенерации от одноразовых клипов к непрерывно редактируемому стримингу.

Почему это важно
Самая поддержанная статья HF Daily Papers за 2026-09-15 с 532 апвоутами; к статье прилагается играбельное публичное демо.

ZGCM-1: полностью открытая и крайне эффективная 7B-модель для математики и агентного поиска

ZGCAGI
исследования официальный 2 ист. ~1 мин

Полностью открытая плотная модель на 7B, обученная с нуля, которая догоняет куда более крупные фронтир-модели (Qwen3-235B, GLM-5.1) в математических рассуждениях и агентном поиске, сочетая вдумчивое внутреннее рассуждение с активным использованием инструментов на контексте 256K. Включает стабильный FP8-оптимизатор Muon, mid-training в формулировке MDP, рой агентов, управляющий R&D-процессом, и полный релиз весов, чекпоинтов, кода, данных и рецептов.

Почему это важно
291 апвоут на HF Daily Papers; необычно полный open-source релиз всего пайплайна обучения, с ростом эффективности предобучения в 4,2 раза и восемью выжимками эмпирических выводов.

Dream-RSI: рекурсивное самоулучшение через эволюционирующие миры

Google
исследования официальный 2 ист. ~1 мин

Накопленная история открытий агента превращается в симулятор реплеев, в котором обучается политика исследования («сновидение»), давая дешёвую off-policy обратную связь вместо дорогих онлайн-прогонов. Улучшенная политика возвращается в работу для новых открытий, расширяющих симулятор, замыкая цикл рекурсивного самоулучшения как ненавязчивый слой оркестрации поверх неизменного кодинг-агента.

Почему это важно
263 апвоута на HF Daily Papers; конкурентное или лучшее качество открытий при меньших затратах в инженерии алгоритмов, математической оптимизации и инженерии GPU-ядер.

Стоит знать (3)

Suno признала в судебном документе использование аудио с YouTube, собранного через YT-DLP, для обучения

Suno
аудио только СМИ 4 ист. ~1 мин

В ответе на 26 страниц, поданном в Окружной суд США штата Массачусетс, Suno признала, что «аудиоданные были получены с YouTube для использования в качестве обучающих данных с помощью YT-DLP», подтвердив обвинения лейблов в stream-ripping по делу UMG/Capitol/Sony. Одновременно Suno оспорила право лейблов на иск по DMCA Section 1203(a), повторила аргументацию fair use и обвинила мейджоров в антиконкурентном поведении. Лейблы требуют до $150 000 за произведение по 560 записям; сбор фактических данных завершается 30 сентября.

Почему это важно
Первое прямое признание крупной генеративной музыкальной компании в обходе защит YouTube ради обучающих данных усиливает иск по DMCA и создаёт прецедентный риск для всей индустрии генеративного аудио.

Алиса ИИ от Yandex теперь сама выбирает уровень интеллекта для каждого запроса, режим Expert бесплатен

Yandex
модели/LLM офиц. + СМИ 4 ист. ~1 мин

Yandex внедрил систему автоматической маршрутизации для Алисы ИИ, которая оценивает вычислительные потребности каждого запроса и подбирает подходящую модель: простые запросы уходят быстрым моделям, а сложные многошаговые задачи активируют режим Expert, который показывает свои рассуждения, планирует действия через harness и умеет анализировать несколько загруженных файлов. Expert сейчас бесплатен и безлимитен, самая тяжёлая нагрузка в дальнейшем будет зарезервирована за подписчиками Alice Plus.

Почему это важно
Адаптивная маршрутизация моделей повторяет то, что глобальные фронтир-ассистенты делают уже сейчас, и показывает, что Yandex конкурирует оркестрацией и дизайном harness, а не масштабом самой модели — это согласуется с его заявлением о расходах на ИИ в 20–30 раз меньше, чем у OpenAI или Google.

Creatify запустила Boreal — realtime-видеомодель для рекламы по цене один цент за секунду

Creatify
видео офиц. + СМИ 2 ист. ~1 мин

15 сентября Creatify представила Boreal — модель text-to-video и image-to-video, дообученную на рекламных съёмках для точности передачи продукта и айдентики создателей. Она рендерит в реальном времени (1 секунда видео за секунду GPU-времени) с качеством класса 720p, совместной генерацией аудио и видео и сохранным lip-sync по цене $0,01 за секунду готового видео. В собственных слепых тестах её предпочитали открытой базовой модели в 81% решающих сравнений; заявляется примерно 40-кратное преимущество в скорости и 12-кратное в цене против Seedance 2.0. Доступна через Creatify API, Model Playground, AdFlow и fal.ai.

Почему это важно
Цена $0,01 за секунду с realtime-рендерингом задаёт новый нижний порог для пригодной рекламной видеогенерации, давя на флагманские модели ценой, а не разрешением.
Справочно (4)

Anthropic расширяет Claude for Small Business: 43 воркфлоу и 27 интеграций

Anthropic
инструменты официальный 2 ист. ~1 мин

Anthropic добавила в Claude for Small Business 43 воркфлоу и 27 интеграций — Shopify, Salesforce, TikTok, Atlassian, Zoom, Xero, Square, Stripe и Zapier — и запустила Salesforce in Claude (бета) с 37 готовыми sales-скиллами. Продукт, установленный более 900 000 раз с мая, теперь расширяется от бэк-офисных задач до обработки лидов, подготовки предложений и маркетинга; новые воркфлоу работают в режиме подтверждений Claude Cowork.

Почему это важно
Anthropic превращает Claude из ассистента в слой управления малым бизнесом с богатыми коннекторами, напрямую конкурируя с вертикальными SaaS-воркфлоу.

Claude Code v2.1.273 закрывает обход разрешений в sandbox и добавляет hint-заголовки для gateway

Anthropic
инструменты официальный 1 ист. ~1 мин

После v2.1.271 от 14 сентября (fast mode для удалённых сессий, по-командный allowlist сетевых доменов в sandboxed auto mode, --accept-command <sha256> для установки плагинов) вышла v2.1.273 от 15 сентября: опциональные заголовки класса запроса для gateway (CLAUDE_CODE_GATEWAY_HINT_HEADERS=1), форкинг сессии из приложения Claude и исправление обхода sandbox, при котором непарсируемые Bash-команды пропускали запрос разрешений.

Почему это важно
Исправление обхода запросов разрешений в v2.1.273 важно всем, кто запускает Claude Code с sandbox в CI или на недоверенных репозиториях.

Cline выпустил Desktop v0.0.28, CLI v3.0.62 и SDK v0.0.83 с плагинами агентов через Hub

Cline
инструменты официальный 1 ист. ~1 мин

15 сентября Cline выпустил три компонента. CLI v3.0.62 переводит Agent Plugins на обнаружение через Hub из ~/.agents/plugins/*, закрывает уязвимый вложенный undici@5.29.0 (CVE-2026-1525) и чинит OOM при запуске из домашнего каталога. SDK v0.0.83 добавляет RemoteEnvironmentService для запуска сессий на SSH-хостах, повторные попытки в середине потока с экспоненциальной задержкой и skills, доступные как plugin-name:skill-name. Desktop v0.0.28 исправляет зависания при медленном старте бэкенда и работу IME, а каталог моделей вырос до 6 079 моделей.

Почему это важно
Плагины через Hub вместе с SSH RemoteEnvironmentService двигают Cline к той же модели удалённых/делегированных агентов, что у Claude Code и Cursor.

Ollama v0.34.1 выводит создание MLX-моделей из safetensors из эксперимента и ускоряет /api/tags в десять раз

Ollama
инструменты официальный 1 ист. ~1 мин

Ollama v0.34.1 (14 сентября) делает создание моделей из MLX safetensors через `ollama create` неэкспериментальным, улучшает управление памятью MLX на Apple Silicon и сокращает холодный ответ /api/tags с ~3,1 с до 294 мс на больших библиотеках моделей. Создание GGUF-моделей теперь требует инструментов llama.cpp для конвертации safetensors, а typical_p объявлен устаревшим при создании новых моделей. v0.34.2-rc0 (15 сентября) обновляет llama.cpp.

Почему это важно
Стабилизация создания MLX-моделей превращает Apple Silicon в полноценный путь для сборки и квантизации локальных моделей внутри Ollama.