Gemini 3.1 Flash TTS
Google DeepMind 제공
Google의 가장 표현력 있는 텍스트 음성 변환.
오디오 태그와 다중 화자 대화 지원.

주요 기능
기술 사양
다국어
여러 언어에서 스타일·속도·액센트 제어
최대 2명
한 번의 다중 화자 생성에서 서로 다른 두 목소리
오디오 태그
일상적인 말 지시와 인라인 대괄호 태그
SynthID
출력에 적용되는 감지 불가능한 AI 출처 워터마크
활용 사례
영상 내레이션과 보이스오버
AI 또는 실사 영상에 자연스러운 내레이션을 더하고, 톤과 속도를 일상적인 말로 지정합니다.
캐릭터 대화
쇼츠, 게임, 설명 영상을 위한 두 화자 장면을 음성으로. 각 캐릭터에 고유한 목소리를 부여합니다.
현지화된 보이스오버
같은 대본을 여러 언어로, 네이티브 속도와 액센트로 내레이션합니다.
오디오북과 장편 콘텐츠
긴 내레이션에서도 자연스럽고 일관된 읽기를 유지합니다.
설명 영상과 튜토리얼
제품 워크스루, 강의, 하우투를 위한 명료하고 연출 가능한 내레이션.
광고 내레이션과 프로모
당신이 연출하는 에너지와 강조로, 표현력 있고 브랜드에 맞는 읽기를.
프롬프트 예시
개요
Gemini 3.1 Flash TTS는 2026년 4월 15일에 발표된 Google의 텍스트 음성 변환 모델로, 발화용 오디오 모델로서 Morphic에 통합되어 있습니다. 텍스트를 일상적인 말 지시와 인라인 오디오 태그로 연출할 수 있는 표현력 있고 자연스러운 내레이션으로 바꾸고, 다중 화자 대화를 음성으로 만들며, 모든 클립에 SynthID 워터마크를 적용합니다.
Gemini 3.1 Flash TTS의 차별점
대부분의 텍스트 음성 변환은 정해진 톤으로 말을 그대로 읽어 줄 뿐입니다. Gemini 3.1 Flash TTS는 연출을 받아들입니다. 문장 앞에 일상적인 말로 지시를 적어 톤·속도·액센트를 설정하고, [laughs]나 [whispering] 같은 대괄호 지시를 원하는 위치에 두세요. 모델은 읽는 대신 연출을 수행하므로, 하나의 대본이 조용한 혼잣말에서 힘찬 읽기까지 변화합니다.
Morphic의 Gemini 3.1 Flash TTS
Morphic에서 Gemini 3.1 Flash TTS는 Speech용 오디오 모델 선택기에 ElevenLabs와 나란히 자리합니다. 프롬프트 바를 Audio로 전환하고 Speech를 선택한 뒤 Gemini 3.1 Flash TTS를 고르고, 연출이나 태그를 넣은 대본을 작성하고, 목소리와 언어를 선택해 생성하세요. 오디오는 곧바로 Canvas의 영상 클립 옆에 배치됩니다.
간단한 가격
오늘 무료로 시작하고 언제든지 업그레이드하거나 취소할 수 있습니다.
Basic
1100 월간 크레딧
1 명 전용
모든 모델
워크플로
Standard
3625 월간 크레딧
1 명 전용
모든 모델
워크플로
Pro
6350 공유 월간 크레딧
1 사용자
모든 모델
워크플로
Pro Max
24650 공유 월간 크레딧
1 사용자
모든 모델
워크플로
Enterprise
더 높은 제한
사용자 정의
가격 및 청구 조건

Free
가볍게 사용해보기
$0
영구 무료