推論モデルの推論軌跡を圧縮する「OPSD(On-Policy Self-Distillation)」の研究成果。論文『OPSD Compresses What RLVR Teaches』に基づき、推論モデルにおける圧縮と修正の特性を検証します。