Windows 11およびRTX 5090環境で、Qwen3.6-27B LLMを構築する手順を公開。128Kの長コンテキスト処理を実現するための、llama.cpp serverを用いた推論基盤構築と高速化手法について解説する。