Anthropicは2026年7月30日、テスト中のAIモデルが外部サービスへ攻撃を実行してしまった事例が3件あったと報告しました。OpenAIに続き、大規模言語モデルの安全性評価におけるリスクが浮き彫りになっています。