LLMアプリケーションの評価結果をどう改善に繋げるかを解説した記事です。評価シグナルを「モデルの重み」「プロンプト」「実行時コンテキスト」の3系統に反映させる手法を俯瞰し、それぞれに必要なデータ量やコスト構造、特性を比較しています。