お問い合わせ
AIニュース

Google Gemini 3.8 Live発表 97言語リアルタイム音声AI・会話中バックグラウンド推論対応

この記事の監修者 株式会社デジタルゴリラ

Googleは2026年9月15日、リアルタイム音声AIモデル「Gemini 3.8 Live」と「Gemini 3.8 Live Extended Thinking」を発表した。97言語対応・会話を止めずにバックグラウンドで多段推論を実行できる設計で、Gemini APIで即日利用可能となっている。

97言語・バックグラウンド推論対応の音声AIがAPIで即日公開

Gemini 3.8 Liveはコスト効率と視覚的グラウンディング(カメラ映像を参照しながら対話できる機能)を重視した標準モデル。Gemini 3.8 Live Extended Thinkingは複雑なタスクや複数ステップの推論に特化した上位モデルで、バックグラウンドでAPIやツール呼び出しを実行しながらも会話フローを中断しない。

両モデルは97言語に対応し、会話途中でも言語を自動検出・切り替え。外国人スタッフとの現場コミュニケーションや多言語カスタマー対応に応用しやすい水準に達している。AI生成音声すべてにSynthID電子透かしが付与されるため、AI対応かどうかをシステム側で識別できる。規制対応が求められる業種でも導入しやすい設計だ。

開発者向けにはGemini APIとGoogle AI Studioで即日利用可能。エンタープライズ向けのGemini Enterpriseは現在プライベートプレビュー段階で、一般提供時期は未定となっている。

“For developers and enterprises, these models deliver the building blocks for reliable, production-ready voice agents.”

(筆者意訳:開発者と企業向けに、信頼性の高い本番環境対応の音声エージェントを構築するための土台を提供します。)

Tom Ouyang(Principal Engineer)/ Malini Jaganathan(Member of Technical Staff, Google Gemini Audio Team)


出典: Google「Introducing Gemini 3.8 Live and 3.8 Live Extended Thinking」(2026年9月15日)

AI活用の社内展開でお困りですか?

株式会社デジタルゴリラ