NVIDIA DGX Spark 2台をRoCEv2で接続し、大規模マルチモーダルモデル「GLM-5.3-Flash-NVFP4」を分散推論でデプロイした技術記録。ネットワーク設定から推論実行までの手順をまとめる。