AIの推論能力を測るベンチマーク「ARC-AGI-3」において、OpenAIがスコアを3倍に向上させた手法を解説しています。ルールが明示されない未知の課題に対し、特定の2つの設定を有効にすることで劇的な性能向上が見られました。