
テクノロジー
Google、最新音声合成モデル「Gemini 3.1 Flash TTS」を発表:動画編集からゲームまで激変させる声インターフェースの未来とは
Googleは、音声合成技術の停滞を打破する「Gemini 3.1 Flash TTS」を展開し、オーディオタグにより音声の感情表現や抑揚を細かく制御可能にした。この技術は70以上の言語と多様な方言に対応し、高品質なAI音声の民主化とグローバル展開を加速させる。
別名: Gemini 3.1 Flash
GoogleのGeminiファミリーに属する最新の音声合成モデル。オーディオタグによる感情やトーンの制御、70以上の言語サポート、SynthIDによる電子透かしの埋め込みなどの特徴を持ち、ElevenLabsなどの競合を凌駕する品質とコストパフォーマンスを実現している。

Googleは、音声合成技術の停滞を打破する「Gemini 3.1 Flash TTS」を展開し、オーディオタグにより音声の感情表現や抑揚を細かく制御可能にした。この技術は70以上の言語と多様な方言に対応し、高品質なAI音声の民主化とグローバル展開を加速させる。

NVIDIAは、量子コンピューターの最大課題であるエラー訂正をAIで解決するため、オープンソースAIモデル群「NVIDIA Ising」を発表した。このモデルは、量子プロセッサーの自動キャリブレーションとリアルタイムエラー訂正をAIに担わせ、エラー率を劇的に削減することで、量子コンピューティングの実用化を加速させることを目指している。