LLM生成を高速化する「MTP(Multi-Token Prediction)」の仕組みを解説。特に、拡散モデル(Diffusion Model)を応用して複数トークンをまとめて予測する手法「DFlash」の特徴に焦点を当てます。