AI企業が大規模言語モデル(LLM)の学習用データとして物理的な書籍を大量に購入し、使用後に破棄しているという報告が上がっています。これらの企業は直接的な調達を避け、中間業者を利用して秘密裏に書籍を買い集めている疑いがあり、著作権や資源の観点から議論を呼んでいます。