📌Alibaba представила Qwen-Audio-3.0-TTS
Alibaba випустила нову модель синтезу мовлення Qwen-Audio-3.0-TTS. Вона підтримує керування емоціями, стилем мовлення та клонування голосу, а також доступна у двох версіях для різних сценаріїв використання.
🔆Детальніше
• Flash оптимізована для голосових інтерфейсів і роботи в реальному часі.
• Plus робить акцент на природності мовлення та точній передачі тембру голосу.
• Підтримує 16 мов і дозволяє задавати стиль мовлення звичайним текстом.
• Доступні 86 спеціальних тегів для керування емоціями, темпом, інтонацією та неречовими звуками.
• Клонує голос навіть із записів із фоновим шумом і генерує до 3 хвилин аудіо за один запуск.
• Qwen-Audio-3.0-TTS Plus очолила рейтинг Artificial Analysis TTS Arena.
➡️Документація API тут.
➡️Детальніше тут.
➡️Запроси друга до НейроЄнота🦝
📌Alibaba представила Qwen-Audio-3.
Нейроєнот | Нейромережа Midjourney, chat GPT та інші
@neuroenotЗахопливо про нейромережі та проривні технології. Ласкаво просимо у майбутнє. #добірка - добірка всіх новин за тиждень Для друга: https://t.me/neuroenot Співпраця та зв'язок: @New_Life_Technology
14,339 מנויים
פתח בטלגרם 2 שתי תמונות מצורפים לפוסט זה — גלויים באפליקציית טלגרם.