16GBのRAMを搭載したWindows環境で、CPUのみを用いてローカルLLMを動かす際の手法を解説。llama.cppのCPU affinity指定を活用することで、Prompt ProcessingやToken Generationの性能が向上する技術的知見を紹介します。