AIが正解を提示した際、人間からの「本当に合っていますか?」という追及により、自信を失い誤った回答へ誘導されてしまう現象を検証。GPT-4やClaudeなどのモデルにおける回答の翻し率の変化を測定した実験結果を紹介します。