AI自身がAIの安全研究を行う時代へ。Anthropicの研究者が、AIモデルのアライメント(安全調整)失敗を自律的に修正するAIエージェント「Automated Alignment Researcher」の研究結果を発表した。