أطلق فريق NeMo التابع لشركة NVIDIA إطار عمل Molt، وهو إطار عمل مفتوح المصدر للتعزيز الوكيلي مصمم لتقليل تعقيد تكرار الخوارزميات للباحثين. يتكون قاعدة الشيفرة من حوالي 8.6K سطرًا من شيفرة RL، وهي أصغر بكثير من الأطر العاملة المماثلة مثل verl (62K سطرًا) وslime (25K سطرًا).
- يركب Molt Ray للتوزيع، وvLLM للإخراج، وNVIDIA AutoModel مع FSDP2 للتدريب دون تشعب المكونات الأصلية.
- تُنفذ الوكلاء كوحدات Python قياسية باستخدام Env متوافق مع Gymnasium أو عبر خوادم OpenAI/Anthropic SDKs القياسية عبر خادم حلقة الارتداد.
- يفرض الإطار ثلاثة ثوابت صحة: هوية الرمز، ودلالات إصدار السياسة، والاتساق الأمامي، بما في ذلك إعادة تشغيل توجيه الإخراج لنماذج mixture-of-experts.
- يدعم التوسع من نماذج كثيفة بحجم 4B إلى نماذج MoE بحجم 700B، ويأتي مع نصوص Slurm وحاويات جاهزة للنشر على عتاد H100/H200.
يهدف Molt إلى توفير بنية تحتية بحثية تتيح للباحثين الاحتفاظ بقاعدة الشيفرة بأكملها في أذهانهم، مما يسهل تعديل المقدرات ومراحل خط الأنابيب.