WindowsかつCPUのみでローカルLLMを動かしたい層に向けた最適化手法。ik_llama.cppでCPU affinityを指定することで、SMT対応CPUでの推論速度を向上させる検証結果です。