Google, 100개 언어 지원 Gemini 음성 합성 모델 출시
Google이 자연어 지시로 세부 표현을 조절하는 음성 생성 모델을 선보였어요.
Google은 100개 이상의 언어를 지원하는 음성 생성 모델인 Gemini 3.8 Flash TTS와 Gemini 3.8 Flash-Lite TTS 2종을 공식 발표했어요. 이번 모델은 자사 최고 수준의 표현력을 갖춘 음성 합성 도구로 안내되었어요. 제작자와 기업은 자연어 프롬프트를 활용해 세부 연출을 제어하고 대규모 확장을 거쳐 풍부한 오디오 경험을 구축할 수 있어요.
다국어 지원과 세밀한 프롬프트 제어를 결합해 음성 콘텐츠 제작 진입 장벽을 낮춘 사례로 볼 수 있어요.
사용자가 텍스트 프롬프트만으로 원하는 톤과 분위기의 음성을 대규모로 만들어내는 환경이 마련된 셈이에요.
지원 언어 전반에서 고유한 억양과 연출 제어가 얼마나 정밀하게 유지될지에 주목할 만해요.