Google выпустила голосовую Gemini, которая выполняет задачи, не прерывая разговор
Новость опубликована 15.09.2026 ⦁ источник
Google 15 сентября выпустила две голосовые модели — Gemini 3.8 Live и Gemini 3.8 Live Extended Thinking. Они принимают текст, изображение, звук и видео, а во время разговора могут вызывать функции и API в фоне: модель продолжает отвечать голосом, пока внешний инструмент выполняет задачу.
Обычная Gemini 3.8 Live рассчитана на низкую задержку. Версия Extended Thinking предназначена для многошаговых запросов: она может одновременно вести диалог, рассуждать и сообщать о ходе работы. Google также заявляет автоматическое переключение между 97 языками и использование видеопотока как контекста.
По данным Google, Extended Thinking получила 82,6 балла и первое место в индексе качества речи Artificial Analysis, выполнила 68,6% заданий τ-Voice и 35,1% банковских сценариев Sierra τ-Voice. Это результаты отдельных тестов, приведённые разработчиком: они не доказывают такую же надёжность во всех разговорах, а подробные размеры выборок и интервалы неопределённости в анонсе не указаны.
Обе модели уже доступны разработчикам через Gemini API и Google AI Studio. Gemini 3.8 Live также появляется в Search Live, а Extended Thinking — в Gemini Live и части сервисов Workspace для подписчиков; корпоративные версии пока находятся в закрытом предварительном доступе. Главное изменение здесь не более естественный голос сам по себе, а возможность не ставить разговор на паузу ради вызова инструментов и многошаговой работы.
Google, Gemini 3.8 Live, Gemini 3.8 Live Extended Thinking, Gemini API, Голосовые модели, Асинхронный вызов функций