Google запустила клонирование голоса по 30‑секундному образцу в Gemini 3.8 Flash TTS
Новость опубликована 23.09.2026 ⦁ источник
Google 23 сентября выпустила Gemini 3.8 Flash TTS и Flash-Lite TTS. Старшая модель может создать устойчивый голосовой профиль по 30-секундной записи человека, который дал право её использовать. Перед клонированием сервис требует отдельную запись устного согласия и сверяет говорящего с образцом.
Flash TTS уже доступна разработчикам через Gemini API и Google AI Studio. Там же можно с нуля создавать голоса для персонажей, задавать манеру каждой реплики и собирать сцены с двумя собеседниками; Google заявляет поддержку более 100 языков и диалектов и предлагает свыше 2000 готовых голосов. Клонирование пока недоступно в Иллинойсе, Техасе, ЕЭЗ, Великобритании, Швейцарии и Индии. Облегчённая Flash-Lite TTS рассчитана на массовую озвучку, но не заявлена как отдельный инструмент клонирования.
Каждая созданная запись, по данным Google, получает незаметную метку SynthID, а для клонированных голосов добавляются сведения C2PA. Проверка согласия затрудняет прямое копирование чужого голоса через официальный интерфейс, но не доказывает защиту от обхода: компания не раскрыла долю ложных допусков и отказов или результаты независимого испытания этого механизма.
Google приводит собственные и внешние рейтинги качества, но независимой проверки нового выпуска пока нет. В карточке Gemini 3.8 Audio компания отдельно пишет, что в оценке предельных рисков не считает модели существенным приростом возможностей по сравнению с Gemini 3.7 Flash. Главное изменение релиза — доступное управление голосом и клонирование с заявленной проверкой согласия, а не доказанный универсальный скачок качества речи.
Google, Gemini 3.8 Flash TTS, Gemini 3.8 Flash-Lite TTS, Синтез речи, Клонирование голоса