RTX 4070 Ti SUPER 16GBを用い、Qwen3.8 27Bモデルをllama.cppで動作させた検証結果。量子化やSpeculative Decodingを駆使し、262Kコンテキストでの推論速度などを計測した実用的なレポート。