1.5B規模の小型LLMを自前GPUで運用する際の技術的課題と解決策を解説。指示無視や誤字といった「事故」を、どのように計測し、プロンプト等の制約で制御し、モデルを選定したかを要件定義から運用まで5日間の判断プロセスとして公開。