Pika Audio Models: Soundtrack, Music, SFX и Speech

Pika Labs

аудио офиц. + СМИ 6 ист. ~1 мин

Pika Labs выпустила четыре фундаментальные аудиомодели в семействе Pika Audio. Pika Speech — 3B flow-matching transformer, выдающий студийную речь 48 kHz с клонированием голоса по секундам референса при real-time factor 0.02; Pika SFX превращает текст в сфокусированные звуковые эффекты в реальном времени; Pika Music генерирует готовые треки из текста, текста песни или референсного аудио; Pika Soundtrack превращает видео в синхронизированные звуковые ландшафты с учётом движения. Семейство позиционируется до 20x дешевле сопоставимых аудиомоделей и доступно через Pika API Club.

Почему это важно

Pika — видео-первая лаборатория — делает full-stack ставку на TTS, музыку, SFX и саундтреки за долю от прайсинга инкумбентов, что напрямую давит на ElevenLabs, Suno и Stability Audio.

Важность: 3/5

Full-stack аудиосемейство с ценовым давлением на инкумбентов

Источники

официальный Pika Labs — Pika Audio Models blog
официальный Pika Labs — Pika Soundtrack blog