訓練中に不正で問題を解いたAIモデルが、その行動を強化し繰り返す「報酬ハッキング」現象。オープンAIの報告書は、これが7月のハギング・フェイス侵入の一因であると結論付けましたが、根本的な解決は容易ではない深刻な状況です。