#tts
- ElevenLabs превышает $500M ARR, BlackRock и Nvidia вошли в раунд Series D ElevenLabs audio
- OpenAI выпускает GPT-Realtime-2, GPT-Realtime-Translate и GPT-Realtime-Whisper OpenAI audio
- ElevenLabs превысила $500 млн ARR и закрыла раунд Series D с BlackRock и NVIDIA ElevenLabs audio
- ByteDance запускает Seed-Audio 1.0: унифицированная генерация речи, музыки и фоновых звуков ByteDance audio
- NVIDIA выпускает Nemotron-Labs-Audex-30B-A3B: единая MoE-модель для аудио и текста NVIDIA audio
- ElevenLabs внедряет аудиоводяной знак SynthID от Google DeepMind для пользователей бесплатного тарифа ElevenLabs audio
- Runway запускает Media Router — API автоматического выбора модели для генеративных медиа Runway tools
- Pika запускает Pika Audio: четыре фундаментальные звуковые модели фронтир-класса со стоимостью до 20 раз ниже Pika audio
- Pika Audio Models: Soundtrack, Music, SFX и Speech Pika Labs audio
- ElevenLabs запускает Avatars в ElevenCreative: AI-видео с говорящей головой на базе TTS ElevenLabs video
- ElevenLabs лицензирует голос и образ Stan Lee для коммерческого использования в AI ElevenLabs audio
- xAI расширяет Grok Voice 21 новым многоязычным флагманским голосом xAI audio
- xAI Grok Voice становится движком по умолчанию для 2,5M+ голосовых агентов Vapi xAI audio