ローカルLLMにおけるホットスタンバイやモデル常駐といった用語を整理し、llama-serverを活用した可用性設計の指針を示す。用語の混同を防ぎ、ローカルAIエージェントの安定運用を実現するための技術的視点を解説。