أصدر مشروع llama.cpp الإصدار b10705، والذي يتضمن تحسينًا لآلية معالجة TENSOR_READ_LAZY. يجبر هذا التحديث الأصفار المتأخرة على وحدة المعالجة المركزية عند تمكين الإعداد المتأخر.

  • تحسين معالجة TENSOR_READ_LAZY في llama.cpp
  • سلوك موحد للأصفار المتأخرة على وحدة المعالجة المركزية عندما يكون الوضع المتأخر نشطًا

يوفر هذا الإصدار ملفات ثنائية محدثة لأنظمة macOS وLinux وWindows وAndroid وiOS عبر خلفيات عتادية مختلفة تشمل CPU وCUDA وROCm وVulkan وOpenVINO.