8GB級GPUでのローカルLLM運用の最適化実験。Gemma 4系モデルの多言語トークンを削除し、再学習なしでVRAM消費を抑える試み。語彙の47.14%削減に成功し、ハードウェア制約下での効率化を図った。