DeepSeek-V4-FlashのモデルサイズをREAP手法を用いて縮小し、128GBのメモリ環境で効率的に動作させる手法。エキスパートを256から128へ枝刈りすることで、チェックポイントを約半分の82GBまで軽量化しました。低スペック環境でのキャリブレーションとvLLM上での実行性能を検証します。