Pika Audio Models: Soundtrack, Music, SFX и Speech
Pika Labs
Pika Labs выпустила четыре фундаментальные аудиомодели в семействе Pika Audio. Pika Speech — 3B flow-matching transformer, выдающий студийную речь 48 kHz с клонированием голоса по секундам референса при real-time factor 0.02; Pika SFX превращает текст в сфокусированные звуковые эффекты в реальном времени; Pika Music генерирует готовые треки из текста, текста песни или референсного аудио; Pika Soundtrack превращает видео в синхронизированные звуковые ландшафты с учётом движения. Семейство позиционируется до 20x дешевле сопоставимых аудиомоделей и доступно через Pika API Club.
Почему это важно
Pika — видео-первая лаборатория — делает full-stack ставку на TTS, музыку, SFX и саундтреки за долю от прайсинга инкумбентов, что напрямую давит на ElevenLabs, Suno и Stability Audio.
Важность: 3/5
Full-stack аудиосемейство с ценовым давлением на инкумбентов