أصدر مشروع llama.cpp الإصدار b10353، الذي يعالج خطأً حرجًا في عملية ggml_roll على خلفيات CUDA و Metal. سابقًا، كانت موترات المصدر المُبدَّلة (غير المتصلة) تنتج نتائج خاطئة بصمت لأن هذه الخلفيات تتجاهل معلومات الخطوة.

  • تضيف الإصلاحات متطلبات مصدر متصل لكل من نوى roll الخاصة بـ CUDA و Metal، متوافقة مع حماية GGML_OP_ROPE الحالية.
  • يضمن هذا التغيير أن يقوم الجدول بالرجوع إلى تنفيذ وحدة المعالجة المركزية للإدخالات غير المتصلة، والتي تتعامل بشكل صحيح مع الخطوات.
  • تمت إضافة حالة اختبار test_roll مُبدَّلة للتحقق من الإصلاح.

يمنع هذا التحديث تلف البيانات في النماذج التي تعتمد على عمليات ROLL مع تخطيطات ذاكرة غير قياسية.