詳細・ビジネスへの影響
xAIは、システムや各種APIを自律的に操作する「AIエージェント機能」に特化した最新のAIモデル「Grok 4.5」を発表しました。このモデルは、人間の指示に基づいてブラウザの操作やデータ集計、複数ツールの連携処理を自律的にこなす性能が飛躍的に強化されています。
ベンチマーク評価である「Artificial Intelligence Index」のツール実行テストでは歴代最高得点を記録しました。しかし同時に、回答に含まれる事実誤認(ハルシネーション)の発生確率が54%に達するという評価結果も公表され、議論を呼んでいます。
企業実務における自律型エージェントの導入においては、AIの出力を過信せず、重要な判断や承認ステップには必ず人間によるダブルチェック体制を組み込む「人間中心のガバナンス」が今後必須となるとみられます。
