Gemini 3.8 Flash TTS создаёт бесконечную библиотеку голосов из 30-секундного образца
Gemini 3.8 text-to-speech says hello

Google представила две модели синтеза речи: Gemini 3.8 Flash TTS для творческого дизайна голосов и Flash-Lite TTS для массового дубляжа. Теперь можно создать голос с нуля текстовым промптом, клонировать тембр по 30-секундной записи и управлять подачей реплик — от шёпота до смеха. Модель заняла первое место в бенчмарке Hume AI Voice Design с результатом 71.4, поддерживает более 100 языков и помечает весь сгенерированный звук водяным знаком SynthID.
Сегодня мы представляем две новые модели синтеза речи в семействе Gemini, превращая генерацию голоса из статичных пресетов в динамичную творческую студию.