A IBM lançou o Granite 4.2, uma família de modelos de linguagem grandes (LLM) de raciocínio densos e apenas-decodificador nos tamanhos de 3B, 8B e 30B. Estes modelos são pré-treinados do zero em aproximadamente 15 trilhões de tokens e possuem uma janela de contexto estendida para 512K tokens.
- O pipeline de treinamento inclui ajuste fino supervisionado em dados de cadeia de pensamento e trajetória agêntica, seguido por aprendizado por reforço multietapa.
- Os modelos de 8B e 30B passam por RL agêntico para aprender o uso de ferramentas dentro de ambientes sandboxed reais, incluindo engenharia de software e busca na web.
- Todos os modelos suportam chamada nativa de ferramentas via endpoint compatível com OpenAI e incluem um interruptor para modos de pensamento ou não-pensamento.
- Os modelos são lançados sob a licença Apache 2.0.