Google、音声対話向けモデル「Gemini 3.1 Flash Live」を発表
Googleが音声AIモデルの最新版「Gemini 3.1 Flash Live」を公開し、応答精度の向上と低遅延化により、より自然で信頼性の高い音声対話を実現したと発表した。
Googleは公式ブログで、音声対話に特化した最新モデル「Gemini 3.1 Flash Live」を発表した。従来モデルからの改良により、音声認識・応答の精度が向上し、レイテンシも低減されたことで、より流暢で自然、かつ正確な音声インタラクションが可能になったとしている。
音声対話AIの改善点
同社によると、今回のアップデートでは応答の精度向上と低遅延化が主な焦点となっている。音声を用いたAIエージェントやアシスタントでは、応答の遅れや誤認識が体験の質を大きく左右するため、こうした改善はリアルタイム性が求められる音声インターフェースの実用性を高めるものといえる。
Gemini Liveシリーズの位置づけ
Geminiシリーズにおける「Live」ブランドは、音声を介したリアルタイム対話に最適化されたモデル群として提供されており、今回の3.1版はその最新の改良版にあたる。自然な会話のやり取りを重視する用途、例えば音声アシスタントやカスタマーサポート、対話型エージェントなどでの活用が想定される。
原文ソース
Google DeepMind