أطلقت IBM نموذج Granite 4.2، وهو عائلة من نماذج اللغة الكبيرة (LLM) للاستدلال الكثيفة والمكونة من فك تشفير فقط بأحجام 3B و8B و30B. تم تدريب هذه النماذج من الصفر على حوالي 15 تريليون رمز وتتميز بنافذة سياق موسعة إلى 512K رمز.

  • يتضمن خط أنابيب التدريب ضبطًا دقيقًا خاضعًا للإشراف على بيانات سلسلة التفكير والمسار الوكيلي، يليه تعلم تعزيز متعدد المراحل.
  • تخضع نماذج 8B و30B لتعلم تعزيز وكيلي (RL) لتعلم استخدام الأدوات داخل بيئات معزولة حقيقية، بما في ذلك هندسة البرمجيات والبحث عبر الويب.
  • تدعم جميع النماذج استدعاء الأدوات الأصلي عبر نقطة نهاية متوافقة مع OpenAI وتشمل مفتاحًا لوضع التفكير أو عدم التفكير.
  • تم إصدار النماذج بموجب رخصة Apache 2.0.