llama.cppのMTP(Multi-Threaded Processing)対応PRがマージされたことを受け、ハイエンド環境(RTX 4090/5080等)を用いて実際にどれほど速度向上したかを検証した報告記事。