AIエージェントの無人本番投入意向、56%に低下

自動化に慎重姿勢

無人投入意向は56%
人のレビュー継続42%

評価と監視の穴

評価通過後の障害61%
品質の即時監視は29%

評価基盤と信頼

OpenAI評価導入59%
実運用とのずれが懸念
詳細を読む

VentureBeat Intelligenceが8月、従業員100人以上の組織を対象に実施した調査で、自律型AIエージェントを導入する企業のうち、人の確認なしで本番変更を許可済み、または12カ月以内の実現に向けて構築中との回答は56%でした。7月の75%から低下する一方、今後も人が本番変更を確認するとした回答は20%から42%へ倍増し、速度より信頼性を重視する動きが鮮明です。

慎重化の背景には、評価を通過した機能でも実運用で事故を起こす現実があります。事前評価を行う組織の61%が過去12カ月に顧客向け障害を少なくとも1件経験し、22%は複数回と回答しました。

本番監視も十分ではありません。自律型エージェント導入組織で、出力の正しさをリアルタイムに自動検査する仕組みを監視の中心に据える回答は29%にとどまり、53%は主にトレースログやゲートウェイ指標を使っていました。

評価基盤の利用は拡大しています。OpenAIの標準評価・トレース機能を使う回答者は7月の31%から8月の59%へ増え、62%は12カ月以内に新規・追加・代替の評価基盤を導入する計画です。

ただし、自動評価を現時点で信頼すると答えたのは9%にすぎず、最大の懸念は実世界の成果との不一致27%、次いで説明可能性の不足24%でした。調査結果からは、低リスク変更に対象を絞り、人の承認と本番品質監視を組み合わせる段階設計が、速度と事故抑止の両立に向けた現実的な選択肢といえます。