IBM выпустила Granite 4.2, семейство плотных декодер-только reasoning больших языковых моделей размером 3B, 8B и 30B. Эти модели обучены с нуля на примерно 15 триллионах токенов и имеют контекстное окно, расширенное до 512K токенов.
- Процесс обучения включает контролируемое тонкое обучение на данных цепочки рассуждений и агентных траекторий, за которым следует многоэтапное обучение с подкреплением.
- Модели 8B и 30B проходят агентное RL для освоения использования инструментов в реальных изолированных средах, включая программную инженерию и веб-поиск.
- Все модели поддерживают нативный вызов инструментов через OpenAI-совместимый эндпоинт и включают переключатель режимов мышления и немышления.
- Модели выпущены под лицензией Apache 2.0.