Claude CodeでFable・Opus・Sonnetの3モデルに「なぞかけ」を生成させ、自己採点能力を実験した記録。上位モデルほど賢いのかという疑問に対し、30本のデータから各モデルの特性を比較する。