OpenAI выкатил GPT-Live — новую голосовую модель для ChatGPT Voice. Фишка в том, что она не переводит речь в текст и обратно, а слышит звук и сразу генерирует ответ голосом, из-за этого задержка падает до 300мс и разговор ощущается как живой.

Модель ещё и улавливает эмоции в голосе — если ты грустишь, раздражён или шутишь, она подстраивает тон ответа под настроение. Работает в полном дуплексе: слушает и говорит одновременно, как человек.

GPT-Live уже доступна в ChatGPT Voice и через API для разработчиков. Голосовые ассистенты понемногу перестают звучать как автоответчик.

[#OpenAI](/search?q=%23OpenAI) [#AIvoice](/search?q=%23AIvoice) [#ChatGPT](/search?q=%23ChatGPT)