أصدر مشروع llama.cpp الإصدار b11157، مقدمًا دعمًا لعمليات الالتفاف ثلاثية الأبعاد باستخدام GEMM الضمني على CUDA. يقوم هذا التحديث بتحسين التنفيذ للتعامل مع النوى الفارغة وهو متاح عبر مجموعة واسعة من المنصات بما في ذلك macOS و Linux و Windows و Android و iOS.

  • يضيف conv3d مع GEMM الضمني لواجهات برمجة تطبيقات CUDA الخلفية.
  • يحسن منطق GEMM الضمني لـ conv3d للتعامل بشكل صحيح مع النوى الفارغة.
  • يوفر ملفات ثنائية لـ CPU و Vulkan و ROCm و OpenVINO و SYCL و Snapdragon على Linux و Windows.
  • يتضمن عمليات بناء لـ macOS Apple Silicon (arm64) و macOS Intel (x64) و iOS XCFramework.
  • يقدم عمليات بناء Android arm64 مع دعم لـ CPU و GPU Adreno و NPU Hexagon.

يوسع هذا الإصدار قدرات تسريع الأجهزة للمكتبة من خلال تمكين عمليات الالتفاف ثلاثية الأبعاد على وحدات معالجة الرسومات NVIDIA.