Gemini 3.8 TTS, 30초 샘플로 목소리를 복제하다

Gemini 3.8 text-to-speech says hello

Gemini 3.8 TTS, 30초 샘플로 목소리를 복제하다

Google이 Gemini 3.8 Flash TTS와 Flash-Lite TTS를 공개했다. 30초 오디오 샘플만으로 목소리를 복제하고, 100개 이상 언어에서 자연어 프롬프트로 새로운 캐릭터 음성을 설계할 수 있다. 대사 단위 연출, 두 화자 장면 구성, 웃음·한숨 같은 비언어 큐까지 지원하며, Hume AI 벤치마크에서 종합 1위를 차지했다. 모든 출력에는 SynthID 워터마크가 삽입된다.

Gemini 3.8 Flash TTS는 Hume AI의 Voice Design Benchmark에서 종합 1위(71.4)를 차지했고, 억양 모델링에서도 1위(60.8)를 기록했다.

이 날의 다른 글

2026-09-23