IBMはGranite 4.2をリリースしました。これは3B、8B、30Bサイズの密集型デコーダーのみ推論大規模言語モデルのファミリーです。これらのモデルは約15兆トークンでゼロから事前トレーニングされており、512Kトークンに拡張されたコンテキストウィンドウを備えています。

  • トレーニングパイプラインには、チェーン・オブ・スレッドおよびエージェント・トラジェクトリデータに対する教師ありファインチューニングが含まれ、その後マルチステージ強化学習が続きます。
  • 8Bおよび30Bモデルは、ソフトウェアエンジニアリングやウェブ検索を含む実際のサンドボックス環境内でのツール使用を学ぶためにエージェントRLを受けます。
  • すべてのモデルはOpenAI互換エンドポイント経由でネイティブツール呼び出しをサポートし、思考モードと非思考モードの切り替えスイッチを含みます。
  • モデルはApache 2.0ライセンスの下でリリースされています。