配信日: 2026-09-17 LLM・モデル重要度: ★★★★★ 読了目安: 約2分

Google、音声AI「Gemini 3.8 Live」公開

REPORTED BY BNF AI NEWS EDITORIAL DESKSPECIAL DISPATCH
Google、音声AI「Gemini 3.8 Live」公開

この記事の要点(3行ダイジェスト)

  • Google DeepMindがリアルタイム音声対話モデル「Gemini 3.8 Live」を公式公開。
  • 対話中に非同期で推論やツール呼び出しを実行する「Extended Thinking」を搭載。
  • 97言語の自動識別とカメラ映像認識に対応し、音声対話品質指標で世界首位を獲得。

は、極めて低遅延なリアルタイム音声対話を実現するフロンティア級マルチモーダルモデル「 Live」、および高度な層を備えた「Gemini 3.8 Live Extended Thinking」を正式公開しました。

本モデルは、従来の音声対話AIの課題であった「思考のための沈黙」を解消し、ユーザーとの自然な相槌や途中経過の報告を行いながら、背後で非同期に複雑な推論ツール呼び出しを実行できる点が最大の特徴です。

97言語の音声を自動識別してシームレスに切り替える能力に加え、スマートフォンのカメラやPCの画面共有を通じたリアルタイム視覚認識にもネイティブ対応しています。

独立系AI評価機関Artificial AnalysisのSpeech-to-Speech品質指標において、音声の自然さや理解力で世界1位を獲得しました。

Google AI StudioおよびGemini APIを通じて開発者向けに提供が開始されており、カスタマーサポートや遠隔保守作業を担う次世代の自律音声基盤として期待が高まっています(一次ソース:Google DeepMind公式発表)。

DAILY AI NEWSLETTER — 朝刊ダイジェスト

毎朝8時、業界の最重要AIニュースを5分でキャッチアップ。

主要モデルの最新発表、現場で即使える実務プロンプト、法規制の動向を専門編集局が毎朝要約してお届けします。

✓ 完全無料✓ 毎朝8:00配信✓ いつでもワンクリック解除✓ スパムゼロ