AgentDojoは、外部ツールを操作するLLMエージェントの安全性と実用性を評価するためのベンチマークです。信頼できないデータ環境下でのプロンプトインジェクション耐性とタスク遂行能力を動的かつステートフルな指標で測定し、エージェントの信頼性を科学的に検証可能にします。