OpenAIとAnthropic、安全機能が通常開発を阻害

誤検知の実態

通常業務での誤検知
拒否対応による時間損失
会話履歴で疑念が固定
実機接続で制限増加

企業と利用者の対応

無害な拒否の削減方針
認定利用者向け制度
防御作業の許可拡大
オープンモデルへの移行
詳細を読む

OpenAIとAnthropicの安全機能が2026年9月、航空宇宙やロボット、サイバーセキュリティーに携わる開発者の通常業務を危険と判定し、作業の中断や別モデルへの切り替えを招いています。AIコーディングエージェントが日常業務に浸透するなか、誤検知への対応時間が、料金とは別の導入コストとして浮上しました。

現場では、シミュレーション上の衛星が軍事用途と疑われたり、ロボットアームの画面作成や別端末へのSSH接続で拒否されたりしています。実機のカメラやセンサーへのアクセスを求めると制限が強まり、いったん会話が疑わしいと扱われると軌道修正が難しいとの声も出ています。

影響は防御目的のセキュリティー作業にも及びます。オープンソースコードの脆弱性確認が拒否を招く例があり、開発者はチャットを破棄するか、KimiやQwenなどのオープンモデルへ処理を移しています。

OpenAIは、GPT-6 AstraとGPT-6.1 SolがGPT-5系より無害な依頼を拒否しにくい一方、追加検査が正当な作業を遅らせたり止めたりし得ると認めました。認定企業やセキュリティー専門家向けには、防御作業を支援するDaybreak Accessを案内しています。

AnthropicもFable 5の誤検知で判断を誤ったと認め、Fable 5.1ではClaude Codeセッション当たりの介入を約60%減らすとしています。ただし侵入試験や攻撃コード生成などは引き続きFable以外へ振り分けるため、企業は安全性だけでなく中断時間と代替経路を含めてAI開発基盤を設計する必要があります。