Gemini 3.8 Flash TTS erfindet Stimmen aus einer einzigen Textzeile
Gemini 3.8 text-to-speech says hello

Google stellt Gemini 3.8 Flash TTS und Flash-Lite TTS vor: Aus natürlichen Sprachprompts entstehen komplett neue Charakterstimmen, über 2.000 fertige Voices decken mehr als 100 Sprachen ab, und eine 30-Sekunden-Aufnahme genügt für die Stimmreplikation. Beide Modelle führen Dialoge mit zwei Sprechern Zeile für Zeile Regie und halten die Qualität über Stunden. Flash TTS führt das Voice-Design-Benchmark von Hume AI an, alle Ausgaben tragen ein SynthID-Wasserzeichen.
Heute führen wir zwei neue Text-to-Speech-Modelle in die Gemini-Familie ein und verwandeln die Stimmgenerierung von statischen Presets in ein dynamisches Kreativstudio.