أطلق مطور حزمة GGUF كاملة لنموذج Nemotron-3-Nano-Omni-30B الخاص بشركة NVIDIA، مما يضيف الدعم الصوتي والفيديو الذي كان مفقودًا سابقًا إلى بيئة llama.cpp. تتضمن الإصدار تسعة أنواع من الكميات تتراوح من Q3_K_M إلى BF16، بالإضافة إلى ملف موحد للمشروع يدمج كلًا من مشفري الرؤية C-RADIO والصوت Parakeet.

  • يُنفّذ فرع مخصص لـ llama.cpp رسم بياني للصوت يعتمد على Parakeet/FastConformer ورسمًا بيانيًا للفيديو يعتمد على C-RADIO، مما يتيح معالجة الفيديو مع مساره الصوتي في مرحلة واحدة.
  • يتطابق الرسم البياني للفيديو مع المرجع الخاص بـ PyTorch من NVIDIA بنسبة خطأ L2 نسبي قدرها 0.0019 بالمائة، بينما ينقل الرسم البياني للصوت سرد الاختبار كلمة بكلمة.
  • تم توفير ثنائيات جاهزة للنظام Linux على معمارية arm64 باستخدام CUDA 13 لأجهزة مثل DGX Spark و Jetson Thor.

يتيح هذا التحديث للمستخدمين تشغيل وسائط متعددة تشمل الصور والنص والصوت والفيديو في وقت واحد من خلال مثيل واحد لـ llama-server على الأجهزة المتوافقة.