2026-07-13 LLM・モデル重要度: ★★★★★

xAI「Grok 4.5」公開、自律動作と高い誤答率が話題に

xAI「Grok 4.5」公開、自律動作と高い誤答率が話題に

この記事の3行要約(斜め読み)

  • APIやシステム操作を行う「エージェント機能」に特化した最新AIモデルを発表。
  • 評価ベンチマークで高スコアをマークするも、回答の誤り(ハルシネーション)が54%に達するとの評価結果も。
  • 実務をAIに完全自律委ねることに対する企業のリスク管理や二重チェックの必要性が浮き彫りに。

詳細・ビジネスへの影響

は、システムや各種を自律的に操作する「機能」に特化した最新のAIモデル「」を発表しました。このモデルは、人間の指示に基づいてブラウザの操作やデータ集計、複数ツールの連携処理を自律的にこなす性能が飛躍的に強化されています。

評価である「Artificial Intelligence Index」のツール実行テストでは歴代最高得点を記録しました。しかし同時に、回答に含まれる事実誤認()の発生確率が54%に達するという評価結果も公表され、議論を呼んでいます。

企業実務におけるの導入においては、AIの出力を過信せず、重要な判断や承認ステップには必ず人間によるダブルチェック体制を組み込む「人間中心のガバナンス」が今後必須となるとみられます。

毎朝のAIトレンドをメールマガジンで受信

AI Guide-Noteが配信する最新のAIニュースや活用ノウハウ、モデル比較情報を毎朝お届けします。 最新情報のキャッチアップや実務への活用にお役立てください。