RTX 5090環境でFreeTokenとgpt-oss-120bモデルを動かした際の実測レポート。WSL2特有のCUDAメモリ問題への回避策と、約50 tokens/sを実現した設定手順を紹介します。