RTX 4080 (16GB)環境にて、Qwen3.6-35B-A3Bのコンテキスト長を8Kから256Kへ拡張した検証結果。VRAM使用量は約3.7GB増加するものの、生成速度は維持されることを確認。KV量子化を活用した常用設定の最適化レポート。