Googleは2026年9月23日、テキスト読み上げモデル
Create and deploy custom audio with our new text-to-speech models:
— Google DeepMind (@GoogleDeepMind) September 23, 2026
🔵 Gemini 3.8 Flash TTS: Design unique voices with distinct accents and characteristics.
🔵 Gemini 3.8 Flash-Lite TTS: Built for efficiency and scale, choose from your created styles or our expansive… pic. twitter. com/ iiZwtRBxgc
Gemini 3.
また近日公開予定の機能として、プロンプトを使って音声ライブラリから選んだ声の音色、ピッチ、ペース、アクセントを微調整して音声を合成できるリミックス機能が搭載される。たとえば
Gemini 3.
どちらのモデルも自然言語で台詞ごとにトーンや演技を指示でき、タイミングを指定して演技させることも可能。また長時間連続した音声でも音声の品質やペース、キャラクターの音色を維持し、ずれを最小限に抑える。さらに
こうした特徴により、Gemini 3.
一方、近年懸念されている声優などの声の権利の保護、本人確認の遵守、コンテンツの透明性確保を徹底するため、音声の生成や複製には厳格な安全対策が講じられているという。たとえば音声複製を行う際に
今回発表の2モデルは順次ユーザに展開される予定で、Gemini 3.
また両モデルとも開発者向けにはGoogle AI Studioで試したり、Gemini API経由で利用が可能。企業ユーザー向けにはGemini EnterpriseのAPI経由で近日公開予定となっている。