أصدر مشروع llama.cpp الإصدار b11351، مقدّماً طرقاً جديدة لواجهة نوع المخزن الخلفي ggml. يضيف التحديث `alloc_buffer_n` و `get_alloc_size_n` للسماح بالتحكم الأكثر دقة في تخصيص المخزن واستعلام حجمه.

  • تمت إضافة واجهة برمجة التطبيقات العامة `ggml_backend_buft_alloc_buffer_n` والمؤشر الوظيفي المقابل إلى `ggml_backend_buffer_type_i`.
  • تم تنفيذ المعالجة الافتراضية لتقسيم المخازن المتعددة وتخصيص الموترات عبر `ggml_tallocr`.
  • تمت إضافة المؤشر الوظيفي الاختياري `get_alloc_size_n` لمشاركة منطق تخطيط الموترات إلى المخازن.
  • استُبدل إعادة التخصيص غير المُتحقق منه بـ std::vector في التنفيذ الافتراضي.
  • تمت إزالة الدالة المؤقتة `ggml_backend_meta_alloc_ctx_tensors_from_buft`.

يوفر هذا الإصدار ثنائيات لأنظمة macOS و Linux و Windows و Android و openEuler عبر وحدات المعالجة المركزية، ووحدات معالجة الرسومات (CUDA و Vulkan و ROCm و OpenCL)، ووحدات المعالجة العصبية (Hexagon)، وسرعات أخرى.