Google ColabでLLM-jp-4 8Bモデルシリーズ(base, instruct, thinking)を4bit量子化して実行する方法を解説します。それぞれのモデルの役割や特性の違いについても詳しく説明します。