# 구글, 음성 합성 AI “제미니 3.8 플래시 TTS” 및 “제미니 3.8 플래시-라이트 TTS” 출시

> https://bookfactory.kr/board/news/19015
> 게시판: 뉴스
> 작성자: tachikoma43
> 작성일: 2026-09-28T23:39:05.390Z

---

구글이 음성 합성 및 텍스트 음성 변환 모델 “Gemini 3.8 Flash TTS”와 “Gemini 3.8 Flash-Lite TTS”를 출시했습니다. 일본을 포함한 100가지 이상의 언어 및 방언에 대응하며, 2000가지 이상의 음성으로 텍스트를 읽어 들일 수 있습니다. Gemini 3.8 Flash TTS와 Gemini 3.8 Flash-Lite TTS는 @GoogleDeepMind의 최신 텍스트… pic.twitter.com/4RnbbjO0fe

Gemini 3.8 Flash TTS는 고도한 처리용 모델로, 자연어 기반 프롬프트를 사용하여 완전히 새로운 음성을 0부터 생성하고, 게임, 오디오북, 팟캐스트 등에서 활용할 수 있습니다. Gemini 3.8 Flash-Lite TTS는 대량 처리용 모델입니다.

다음은 Gemini 3.8 Flash TTS의 작동을 소개하는 영상입니다. “더 낮은 목소리가 좋네”와 같은 인간의 요청에 응답하여 AI가 적절한 음성을 제안합니다. Create your own voices with Gemini 3.8 text-to-speech - YouTube

또한, 30초 간의 음성 샘플을 녹음하여 음성을 재현하는 기능에도 대응합니다. 텍스트를 자신의 목소리로 읽어보도록 할 수 있습니다. 이 음성 재현에는 투명성 확보를 위해 화자에 대한 동의가 필요하도록 되어 있으며, 영화나 애니메이션의 음성을 그대로 입력하여 재현하는 것은 불가능합니다. 수시간 지속되는 연속 음성에서도 높은 음성 품질, 자연스러운 페이스, 캐릭터의 음색을 유지하거나, 여러 사람이 대화하는 듯한 표현을 하거나, 웃음소리, 한숨, 칭찬 등의 반응을 하거나 하는 것이 가능합니다. 음성 AI 벤치마크인 Hume AI에서는 종합 점수에서 1위를 차지했습니다.

인간 기반 선별을 수행하는 Voice Arena는 일본어, 브라질 포르투갈어, 베트남어, 현대 표준 아랍어(MSA) 등에서 상위 위치를 차지하고 있습니다.

보안 조치로서, Gemini Audio 모델 전반과 마찬가지로 생성되는 모든 음성 클립에는 SynthID 워터마크가 삽입됩니다. 이러한 모델은 Google AI Studio에서 체험할 수 있습니다.

[원문 보기](https://gigazine.net/news/20260924-gemini-3-8-flash-tts/) | 출처: Gigazine