Anthropicは、同社のAI「Claude」が、国家の支援を受けた攻撃者による生物兵器の研究要請を拒否したと発表しました。攻撃者はプロキシを利用して検知を回避しようとしましたが、モデルの安全性ガードレールがこれを阻止しました。