Cloudflare Workers AIでモデルを使い分ける際のレイテンシ検証結果。軽量タスクに小型モデルを割り当てても、単価と処理速度が比例しない実情を解説。最適化には計測が不可欠であることを説く。