大規模モデルの分散学習における並列化手法(DP, TP, PP)を時間軸で解説。forward/backward/通信の各フェーズでGPUのメモリや通信がどう動くかを整理し、効率的な設定検討に必要な知識を解説する。