#audio
- MiniMax запускает H3 — омни-модальную модель, генерирующую 2K-видео с нативным стерео-звуком MiniMax video
- ElevenLabs Music v2: смена жанра по ходу трека, inpainting и коммерческий клиренс ElevenLabs audio
- ElevenLabs Music v2 API открывает смену жанров и инпейнтинг ElevenLabs audio
- ByteDance запускает Seed-Audio 1.0: унифицированная генерация речи, музыки и фоновых звуков ByteDance audio
- Google распространяет аудио Veo 3.1 на все инструменты редактирования Flow, добавляет Insert и Remove Google DeepMind video
- Wan-Streamer v0.1: сквозная интерактивная фундаментальная модель реального времени с задержкой менее 550 мс Wan-AI research
- Suno запускает расширенное разделение на стемы с выделением отдельных инструментов Suno audio
- OpenAI добавила водяные знаки SynthID для аудио GPT-Live с API-верификацией OpenAI tools