配信日: 2026-07-13 LLM・モデル重要度: ★★★★★ 読了目安: 約2分

xAI「Grok 4.5」公開、自律動作と高い誤答率が話題に

REPORTED BY BNF AI NEWS EDITORIAL DESKSPECIAL DISPATCH
xAI「Grok 4.5」公開、自律動作と高い誤答率が話題に

この記事の要点(3行ダイジェスト)

  • APIやシステム操作を行う「エージェント機能」に特化した最新AIモデルを発表。
  • 評価ベンチマークで高スコアをマークするも、回答の誤り(ハルシネーション)が54%に達するとの評価結果も。
  • 実務をAIに完全自律委ねることに対する企業のリスク管理や二重チェックの必要性が浮き彫りに。

は、システムや各種を自律的に操作する「機能」に特化した最新のAIモデル「」を発表しました。このモデルは、人間の指示に基づいてブラウザの操作やデータ集計、複数ツールの連携処理を自律的にこなす性能が飛躍的に強化されています。

評価である「Artificial Intelligence Index」のツール実行テストでは歴代最高得点を記録しました。しかし同時に、回答に含まれる事実誤認()の発生確率が54%に達するという評価結果も公表され、議論を呼んでいます。

企業実務におけるの導入においては、AIの出力を過信せず、重要な判断や承認ステップには必ず人間によるダブルチェック体制を組み込む「人間中心のガバナンス」が今後必須となるとみられます。

DAILY AI NEWSLETTER — 朝刊ダイジェスト

毎朝8時、業界の最重要AIニュースを5分でキャッチアップ。

主要モデルの最新発表、現場で即使える実務プロンプト、法規制の動向を専門編集局が毎朝要約してお届けします。

✓ 完全無料✓ 毎朝8:00配信✓ いつでもワンクリック解除✓ スパムゼロ