**Google презентувала **[Gemini 3.5 Transcribe](https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-5-transcribe/)** — свою найточнішу модель для розпізнавання мовлення**

Вона підтримує 85+ мов, сама визначає мову, прибирає «еее» та слова-паразити, ставить таймкоди й розуміє змішані мовні потоки.

За тестами Artificial Analysis, модель показує WER 4% у реальному часі та 2,6% для записаного аудіо.