ITmedia AI+
元記事公開:
ゼロから声を作れる音声生成モデル「Gemini 3.8 Flash TTS」公開 「Gemini Notebook」でも利用可能に
AI要約
Googleが自然言語で声のゼロからの生成や感情制御に対応する音声生成モデル「Gemini 3.8 Flash TTS」を公開した
重要ポイント
- •従来の選択式から進化し、自然言語による声のゼロからの生成や演技・感情の細かな制御に対応している
- •日本語を含む多言語をサポートし、透かし技術「SynthID」も埋め込む仕様となっている
- •開発者向けAPIや各種サービスで順次提供される予定で、「Gemini Notebook」でも利用可能になる