Pika запускает Pika Audio: четыре фундаментальные звуковые модели фронтир-класса со стоимостью до 20 раз ниже

Pika

аудио офиц. + СМИ 4 ист. ~1 мин

14 августа 2026 года Pika выпустила Pika Audio — первое семейство фундаментальных звуковых моделей фронтир-класса, включающее Soundtrack (видео-в-аудио, $0,617/с), Music (песни до 6 минут по тексту/тексту песни/голосу/референсу), SFX (текст-в-звуковые эффекты, 44,1 кГц стерео, средняя задержка 0,847 с) и Speech (TTS 48 кГц с пресетами голосов или клонированием голоса, real-time factor 0,02). Pika позиционирует семейство как до 20 раз более дешёвое по сравнению со сопоставимыми аудио-моделями, с конкретными заявлениями: в 9 раз против ElevenLabs v3, в 4,5 раза против Cartesia/ElevenLabs Turbo и в 2 раза против Hunyuan Foley / Fish Audio.

Почему это важно

Знаменует экспансию Pika из видео-only в полноценный набор фундаментальных аудио-моделей, при этом Speech-модель подаётся как самый дешёвый реальный конкурент ElevenLabs на рынке, а Soundtrack-модель позиционируется как экономичная альтернатива HunyuanVideo-Foley для задачи видео-в-аудио. Доступно через новый Pika API Club ($10/месяц) с агрегацией 70-100+ сторонних моделей.

Важность: 3/5

4 независимых подтверждения; новое семейство фундаментальных аудио-моделей (базовый уровень 2)

Источники