[#news](?q=%23news) [#pika](?q=%23pika) [#AIaudio](?q=%23AIaudio)

[Pika Audio](https://dev.pika.art/models/pika/pika-audio?utm_source=x&utm_medium=caption&utm_campaign=260813-audio_family&utm_content=pika_labs&utm_term=post&utm_id=e8e3e16c-3f47-4870-b5c8-90ce69a6387c)**: 20 хвилин звуку за 6&#036;** 

Pika вийшла за межі відеогенератора. На Pika API з'явилось сімейство з чотирьох аудіо-моделей: ефекти, мовлення, музика і саундтрек під готове відео. Один ключ, однаковий формат запиту на всі чотири.

**Pika SFX**
Текст в аудіо, на виході mp3, дефолтна тривалість 10 секунд. Будь-який звуковий ефект з опису, від скрипу дверей до годинникового механізму. Ціна 0,0002&#036; за секунду.

**Pika Speech**
Текст в аудіо, mp3. 76 голосових пресетів, від calm_documentary_narrator до thunderous_revival_preacher. Плюс клонування голосу з референсного аудіо, але тільки з окремим підтвердженням прав на цей голос. Ціна 0,01&#036; за хвилину.

**Pika Music**
Референс в аудіо, mp3, дефолт 30 секунд. Три режими: text_to_music, voice_conditioned_text_to_music і music_cover. Окремі поля під промпт і під текст пісні, є seed і автодоопрацювання промпту для коротких описів. Клонування голосу теж вимагає підтвердження прав. Ціна 0,015&#036; за хвилину.

**Pika Soundtrack**
Відео у відео, на виході mp4. Приймає H.264 або HEVC до 1200 секунд і 2 ГБ. Міняє тільки звукову доріжку, картинка й хронометраж лишаються недоторканими. Інструкція іде в модель дослівно, а якщо лишити поле порожнім, модель сама читає дію в кадрі. Робоча роздільна здатність близько 576x320 для 16:9, менше апскейлиться. Ціна 0,005&#036; за секунду.

**Загальний висновок:**
Дуже дешево, дуже цікаво, але чогось тестувати не хочеться)))). Питання одне: наскільки воно звучить. Хто тестував - пишіть в коментарях. 

  [TG](https://t.me/+3aYpsHA1MF81NTEy) |  [YT](https://www.youtube.com/@shtuchka-intelekt) |   [IG](https://www.instagram.com/cherner_vova/)