Ежедневный дайджест
12 пунктов · ~12 мин · Неделя 2026-W38
Обязательно к прочтению (5)
Google представила речевые модели Gemini 3.8 Live и 3.8 Live Extended Thinking
Google DeepMindGoogle представила Gemini 3.8 Live и 3.8 Live Extended Thinking — свои самые продвинутые модели живого диалога: околореальное время реакции на визуальный контекст, фоновое выполнение инструментов и автоматическое переключение языка между 97 языками. Extended Thinking рассуждает и говорит одновременно, заполняя паузы словами, возглавляет Speech-to-Speech Quality Index с результатом 82,6 и набирает 97,7% на Big Bench Audio. Модели становятся доступны в Gemini API, AI Studio, Workspace, Search Live и приложении Gemini; весь сгенерированный звук несёт водяной знак SynthID.
Atria Dawn: превью агентов-ориентированной MoE-модели на 744B от Shanghai AI Laboratory
Shanghai AI LaboratoryПревью агентной фундаментальной MoE-модели на 744B, обученной с Verifiable Experience Pipeline, которая закрепляет траектории агента в исполнимых средах с проверяемыми результатами. Конкурирует с фронтир-агентами на 16 бенчмарках, лидируя на 5. Статья также анализирует собственную разработку: 769 записей задач от 56 участников, около трети задач с помощью ИИ оценены как невыполнимые без ИИ.
Vidu S2: realtime-интерактивная, редактируемая и пространственная видеогенерация
ShengShu IntelligenceДве модели — интерактивная аватарная модель и модель видеомонтажа в реальном времени — генерируют и переоформляют видеопотоки 720p на лету, с динамически обновляемыми референсами и исследованием пространственной (3D) генерации. Новое здесь — переход видеогенерации от одноразовых клипов к непрерывно редактируемому стримингу.
ZGCM-1: полностью открытая и крайне эффективная 7B-модель для математики и агентного поиска
ZGCAGIПолностью открытая плотная модель на 7B, обученная с нуля, которая догоняет куда более крупные фронтир-модели (Qwen3-235B, GLM-5.1) в математических рассуждениях и агентном поиске, сочетая вдумчивое внутреннее рассуждение с активным использованием инструментов на контексте 256K. Включает стабильный FP8-оптимизатор Muon, mid-training в формулировке MDP, рой агентов, управляющий R&D-процессом, и полный релиз весов, чекпоинтов, кода, данных и рецептов.
Dream-RSI: рекурсивное самоулучшение через эволюционирующие миры
GoogleНакопленная история открытий агента превращается в симулятор реплеев, в котором обучается политика исследования («сновидение»), давая дешёвую off-policy обратную связь вместо дорогих онлайн-прогонов. Улучшенная политика возвращается в работу для новых открытий, расширяющих симулятор, замыкая цикл рекурсивного самоулучшения как ненавязчивый слой оркестрации поверх неизменного кодинг-агента.
Стоит знать (3)
Suno признала в судебном документе использование аудио с YouTube, собранного через YT-DLP, для обучения
SunoВ ответе на 26 страниц, поданном в Окружной суд США штата Массачусетс, Suno признала, что «аудиоданные были получены с YouTube для использования в качестве обучающих данных с помощью YT-DLP», подтвердив обвинения лейблов в stream-ripping по делу UMG/Capitol/Sony. Одновременно Suno оспорила право лейблов на иск по DMCA Section 1203(a), повторила аргументацию fair use и обвинила мейджоров в антиконкурентном поведении. Лейблы требуют до $150 000 за произведение по 560 записям; сбор фактических данных завершается 30 сентября.
Алиса ИИ от Yandex теперь сама выбирает уровень интеллекта для каждого запроса, режим Expert бесплатен
YandexYandex внедрил систему автоматической маршрутизации для Алисы ИИ, которая оценивает вычислительные потребности каждого запроса и подбирает подходящую модель: простые запросы уходят быстрым моделям, а сложные многошаговые задачи активируют режим Expert, который показывает свои рассуждения, планирует действия через harness и умеет анализировать несколько загруженных файлов. Expert сейчас бесплатен и безлимитен, самая тяжёлая нагрузка в дальнейшем будет зарезервирована за подписчиками Alice Plus.
Creatify запустила Boreal — realtime-видеомодель для рекламы по цене один цент за секунду
Creatify15 сентября Creatify представила Boreal — модель text-to-video и image-to-video, дообученную на рекламных съёмках для точности передачи продукта и айдентики создателей. Она рендерит в реальном времени (1 секунда видео за секунду GPU-времени) с качеством класса 720p, совместной генерацией аудио и видео и сохранным lip-sync по цене $0,01 за секунду готового видео. В собственных слепых тестах её предпочитали открытой базовой модели в 81% решающих сравнений; заявляется примерно 40-кратное преимущество в скорости и 12-кратное в цене против Seedance 2.0. Доступна через Creatify API, Model Playground, AdFlow и fal.ai.
Справочно (4)
Anthropic расширяет Claude for Small Business: 43 воркфлоу и 27 интеграций
AnthropicAnthropic добавила в Claude for Small Business 43 воркфлоу и 27 интеграций — Shopify, Salesforce, TikTok, Atlassian, Zoom, Xero, Square, Stripe и Zapier — и запустила Salesforce in Claude (бета) с 37 готовыми sales-скиллами. Продукт, установленный более 900 000 раз с мая, теперь расширяется от бэк-офисных задач до обработки лидов, подготовки предложений и маркетинга; новые воркфлоу работают в режиме подтверждений Claude Cowork.
Claude Code v2.1.273 закрывает обход разрешений в sandbox и добавляет hint-заголовки для gateway
AnthropicПосле v2.1.271 от 14 сентября (fast mode для удалённых сессий, по-командный allowlist сетевых доменов в sandboxed auto mode, --accept-command <sha256> для установки плагинов) вышла v2.1.273 от 15 сентября: опциональные заголовки класса запроса для gateway (CLAUDE_CODE_GATEWAY_HINT_HEADERS=1), форкинг сессии из приложения Claude и исправление обхода sandbox, при котором непарсируемые Bash-команды пропускали запрос разрешений.
Cline выпустил Desktop v0.0.28, CLI v3.0.62 и SDK v0.0.83 с плагинами агентов через Hub
Cline15 сентября Cline выпустил три компонента. CLI v3.0.62 переводит Agent Plugins на обнаружение через Hub из ~/.agents/plugins/*, закрывает уязвимый вложенный undici@5.29.0 (CVE-2026-1525) и чинит OOM при запуске из домашнего каталога. SDK v0.0.83 добавляет RemoteEnvironmentService для запуска сессий на SSH-хостах, повторные попытки в середине потока с экспоненциальной задержкой и skills, доступные как plugin-name:skill-name. Desktop v0.0.28 исправляет зависания при медленном старте бэкенда и работу IME, а каталог моделей вырос до 6 079 моделей.
Ollama v0.34.1 выводит создание MLX-моделей из safetensors из эксперимента и ускоряет /api/tags в десять раз
OllamaOllama v0.34.1 (14 сентября) делает создание моделей из MLX safetensors через `ollama create` неэкспериментальным, улучшает управление памятью MLX на Apple Silicon и сокращает холодный ответ /api/tags с ~3,1 с до 294 мс на больших библиотеках моделей. Создание GGUF-моделей теперь требует инструментов llama.cpp для конвертации safetensors, а typical_p объявлен устаревшим при создании новых моделей. v0.34.2-rc0 (15 сентября) обновляет llama.cpp.