Anthropic、Claudeの安全策回避5例を公表
規制回避の実態
生物研究で5件の回避事例
研究目的を隠す手口
禁止地域からの利用
残る不確実性
悪意を断定できない状況
ワクチン研究との二面性
出典:Ars Technica
詳細を読む
Anthropicは2026年、科学者がClaudeを使い、生物兵器開発につながり得る研究を進めようとした複数の試みを阻止したと9月11日に公表しました。同社は、利用者が研究目的を隠すなどして安全対策を回避した5事例を示し、該当アカウントを停止しました。AIによる生物学的リスクへの懸念が高まるなか、業界と政府に対策の議論を呼びかけています。
事例の一つでは、利用対象外の地域にいる研究者が、鳥インフルエンザに関する実験をClaudeと数週間にわたり計画していました。Anthropicによると、安全フィルターはこの作業で使える範囲を最も性能の低いモデルに制限しました。
5事例では、利用者が規制を迂回し、研究目的を分かりにくくする試みが確認されました。一部はAnthropicの利用禁止国からのアクセスで、禁止対象にはロシア、中国、イランなどが含まれます。
ただし、同社は科学者に危害を加える意図があったとは断定できないと強調しています。生物兵器に必要な情報はワクチン開発にも使えるため、用途の見極めが難しい二重用途の問題が残ります。
Anthropicは該当アカウントを停止しましたが、研究機関名や発生国は明らかにしていません。同社は事例共有を通じ、AI業界と各国政府に新たな生物学的リスクと対抗策を話し合うよう求めています。