新推論エンジン「Magnitude」と定番「llama.cpp」の速度比較検証。M5 Macにおいて16GBメモリ環境下でGGUFモデルを動作させた際、decode速度や初回トークン生成速度においてllama.cppが優位であるという結果を提示する。