أصدر مشروع llama.cpp الإصدار b10985، الذي يعدّل الخلفية RPC لتقييد التخزين المؤقت القائم على التجزئة حصريًا لأوزان الموترات. يعالج هذا التغيير مشكلة حيث كانت بيانات التنشيط تُجزّأ وتُخزّن دون داعٍ، مما يؤدي إلى استخدام مفرط للقرص.
- دوال `ggml_backend_rpc_buffer_set_tensor` و `ggml_backend_rpc_set_tensor_async` تقوم الآن بتجزئة النقلات فقط للمخازن المؤقتة المحددة بـ `GGML_BACKEND_BUFFER_USAGE_WEIGHTS`.
- بايت جديد `cache_flag` في رسالة SET_TENSOR يشير إلى متى يجب حفظ إدخال ذاكرة التخزين المؤقت، مما يستبدل منطق حالة الانتظار السابق على جانب الخادم.
يمنع هذا التحسين بيانات الحوسبة من ملء مساحة القرص عن طريق ضمان تخزين الأوزان فقط عبر مسار التجزئة.