**📌****Tencent Hunyuan відкрила AuK — універсальну модель для роботи з голосом**

AuK об’єднує генерацію, редагування, очищення та розділення аудіо в одній моделі. Усі ці операції можна задавати звичайними текстовими інструкціями.

🔆**Детальніше**

• AuK має 1,5 млрд параметрів і підтримує клонування голосу за коротким аудіореференсом або створення нового голосу лише за його текстовим описом.

• Вже записане мовлення можна редагувати: додавати, видаляти або замінювати слова, зберігаючи голос, інтонацію та акустичний контекст. Так само можна змінювати слова в пісні без зміни мелодії.

• Текстовими інструкціями можна змінювати емоцію, тембр, акцент, шепіт, сміх, кашель, дихання, швидкість, гучність і висоту голосу.

• Модель також очищає записи, розділяє мовців, може ізолювати конкретного співрозмовника та витягувати вокал з музичного міксу.

• AuK-Flash — швидша версія моделі з 4-кроковим висновуванням. Код і ваги AuK опубліковані під ліцензією MIT.

➡️Демо [тут](/leaving?url=aHR0cHM6Ly9odWdnaW5nZmFjZS5jby9zcGFjZXMvdGVuY2VudC9BdUs=).
➡️Код [тут](/leaving?url=aHR0cHM6Ly9naXRodWIuY29tL1RlbmNlbnQtSHVueXVhbi9BdUs=).

➡️**_Запроси друга до _**[**_НейроЄнота_**](https://t.me/neuroenot)🦝