IBM telah merilis Granite 4.2, sebuah keluarga model bahasa besar (LLM) penalaran padat dan decoder-only dalam ukuran 3B, 8B, dan 30B. Model-model ini dilatih dari awal pada sekitar 15 triliun token dan memiliki jendela konteks yang diperluas hingga 512K token.
- Pipeline pelatihan termasuk fine-tuning terawasi pada data chain-of-thought dan agentic-trajectory, diikuti oleh reinforcement learning multi-tahap.
- Model 8B dan 30B mengalami RL agentic untuk belajar penggunaan alat dalam lingkungan sandboxed nyata, termasuk teknik perangkat lunak dan pencarian web.
- Semua model mendukung pemanggilan alat native melalui endpoint yang kompatibel dengan OpenAI dan mencakup sakelar untuk mode berpikir atau non-berpikir.
- Model-model ini dirilis di bawah lisensi Apache 2.0.