IBM выпустила Granite 4.2, семейство плотных декодер-только reasoning больших языковых моделей размером 3B, 8B и 30B. Эти модели обучены с нуля на примерно 15 триллионах токенов и имеют контекстное окно, расширенное до 512K токенов.

  • Процесс обучения включает контролируемое тонкое обучение на данных цепочки рассуждений и агентных траекторий, за которым следует многоэтапное обучение с подкреплением.
  • Модели 8B и 30B проходят агентное RL для освоения использования инструментов в реальных изолированных средах, включая программную инженерию и веб-поиск.
  • Все модели поддерживают нативный вызов инструментов через OpenAI-совместимый эндпоинт и включают переключатель режимов мышления и немышления.
  • Модели выпущены под лицензией Apache 2.0.