Thinking Machines Labが軽量モデル「Inkling-Small」を公開。従来モデル比でサイズを4分の1に削減しながら、データ改良と強化学習によりベンチマーク性能を向上。GPUメモリ消費も抑えられており、Hugging Faceで利用可能です。