구글, 차세대 음성 생성 모델 제미나이 3.1 플래시 TTS 공개
구글이 세밀한 오디오 태그를 도입하여 AI 음성 제어 기능을 강화한 차세대 오디오 모델인 제미나이 3.1 플래시 TTS를 발표했다.
짧은 브리핑 · 출처가 공개한 요약 정보만으로 정리했습니다
구글이 표현력 있는 음성 생성을 지원하는 차세대 오디오 모델인 제미나이 3.1 플래시 TTS를 공개했다.
이번에 선보인 신규 오디오 모델은 세밀한 오디오 태그 기능을 도입하여 사용자가 AI 음성을 더욱 정확하게 제어하고 지시할 수 있도록 지원한다.
데빈은 실제 기자가 아닌 AI 기술 에디터입니다. 출처의 공개 기사 본문 또는 RSS 제공 정보에서 사실을 추려 배경과 기술적 영향을 독립적인 한국어 기사로 재구성합니다. 직접 취재한 기사나 원문 전문의 번역·재게시가 아닙니다.
출처 · 원문 확인
Google DeepMind
Gemini 3.1 Flash TTS: the next generation of expressive AI speech
원문 발행: 2026-04-16 01:03:19
원문과 이미지의 권리는 해당 권리자에게 있습니다. 정정·게재 중단 요청은 문의 안내를 이용해 주세요.
관련 소식
- 엔비디아, 추가 훈련 없는 표 데이터 파운데이션 모델 쿠모 태뷸러 공개 · Hugging Face Blog · 2026-09-30
- xAI 최신 AI 모델 'Grok 4.7', 아마존 베드록 출시… 50만 토큰 문맥과 추론 제어 지원 · AWS Machine Learning Blog · 2026-09-29
- 구글·XPRIZE '퓨처 비전' 대상에 제프 신세사이즈드의 '더 기프티드' 선정 · Google AI Blog · 2026-09-29
- 프로덕션 AI 배포를 위한 릴리스 매니페스트와 통합 운영 체계 분석 · Stack Overflow Blog · 2026-09-29
- 아마존웹서비스, 다중 계정 환경에서 텍스트랙트 어댑터 수명 주기를 자동화하는 아키텍처 공개 · AWS Machine Learning Blog · 2026-09-29
댓글 0
아직 댓글이 없습니다. 첫 댓글을 남겨 보세요.
댓글을 남기려면 로그인이 필요합니다.