المختبر · Hugging Face
lab Hugging Face Blog · منذ 4 ساعة · مشاهدة واحدة

إطلاق لوحة المتصدرين المفتوحة لتقييم أنظمة تحويل النص إلى كلام متعددة اللغات وقابلة للتوسع

تم إصدار لوحة المتصدرين المفتوحة لأنظمة تحويل النص إلى كلام (TTS) لمعالجة التشتت ونقص المعايير في تقييم هذه الأنظمة، وذلك باستخدام مقاييس موضوعية بدلاً من الاعتماد حصرياً على درجات تفضيل البشر البطيئة والمعتمدة على قاعات التصويت. وتقوم بتقييم النماذج من حيث الوضوح والسرعة وتشابه المتحدثين باستخدام نماذج Qwen3 ASR وتضمينات WavLM.

github llama.cpp · منذ 19 ساعة · مشاهدتان

يحمّل llama.cpp الإصدار b11266 مصفوفة A من نوع F32 بعنصرين في كل مرة لـ Vulkan على معالجات Intel

أصدر مشروع llama.cpp البناء b11266، الذي يتضمن تحسينًا لـ Vulkan يحمّل مصفوفات A من نوع F32 بعنصرين في كل مرة عندما تكون محاذاة بعامل 2. يعالج هذا التغيير مشكلات الأداء على الأجهزة من Intel حيث يكون تحميل الأعداد العائمة واحدًا تلو الآخر غير كفء، كما يصحح نقص التحقق من صحة محاذاة `a_offset` في التصحيح الأصلي.

github llama.cpp · منذ 21 ساعة · مشاهدة واحدة

إصلاح llama.cpp b11265 لاختيار بلاطات matmul MOE في Vulkan

يتضمن إصدار llama.cpp b11265 إصلاحًا لمعالجة نماذج Mixture of Experts (MoE) بواسطة الخلفية الخلفية Vulkan. يصحّج التحديث كيفية اختيار `mat_mul_id` لبلاطات الضرب المصفوفي، مما يعالج مشكلة أداء كانت تترك فيها العمال في حالة خمول أثناء التوجيه.

media MarkTechPost · منذ 1 يوم Android World · 85.1% · 8 مشاهدات

شركة H تطلق نماذج استخدام الحاسوب مفتوحة الأوزان Holo4 لأجهزة سطح المكتب والويب والهاتف المحمول

أطلقت شركة H نموذج Holo4، وهو عائلة من نماذج اللغة والرؤية العامة المستخدمة في الحاسوب، مصممة للنقر والكتابة وكتابة الأكواد واستدعاء الأدوات عبر بيئات سطح المكتب والويب وAndroid وAPI. تتضمن الإصدار حجمين للنماذج: Holo4 27B (كثيف) وHolo4 35B-A3B (مزيج من الخبراء مع 3B معلمة نشطة)، وكلاهما يدعم نافذة سياق بحجم 256K.

media r/LocalLLaMA · منذ 1 يوم · 3 مشاهدات

IQuestLab تطلق IQuest-Q1، نموذج MoE بحجم 320 مليار لمهام البرمجة الوكيلية

أطلقت IQuest نموذج IQuest-Q1، وهو نموذج Mixture-of-Experts (MoE) مصمم للبرمجة الوكيلية والاستدلال واستخدام الأدوات متعدد الخطوات. يتكون النموذج من حوالي 320 مليار معلمة إجمالية، مع تفعيل حوالي 15 مليار معلمة لكل توكن. متوفر على Hugging Face.

github llama.cpp · منذ 2 يوم · 4 مشاهدات

يضيف llama.cpp b11238 ggml_pad_ext للحشو الأيسر ويتخطى نقرات DFlash2

أصدر مشروع llama.cpp الإصدار b11238، مقدّماً تنفيذًا موحدًا للحشو الأيسر عبر الدالة الجديدة `ggml_pad_ext`. يجمع هذا التغيير الأساليب السابقة المستخدمة في مشفرات الصوت مثل Parakeet وLFM2-Audio وGranite Speech وGemma 4، مما يضمن تطابق التضمينات بتًا ببت لـ Gemma 4 مع تبسيط دعم الخلفية.

github llama.cpp · منذ 2 يوم · 3 مشاهدات

يضيف llama.cpp b11228 دعم الحشو الأيسر والدائري في GGML_OP_PAD الخاص بـ Metal

تقدم إصدار llama.cpp b1228 دعمًا للحشو الأيسر والدائري في عملية GGML_OP_PAD للخلفية (backend) الخاصة بـ Metal، مما ينسجم مع تطبيقات CPU و CUDA و Vulkan. يصلح هذا التغيير مشكلات الحشو الأيمن للمصادر المعاد ترتيبها ويضمن سلوكًا متسقًا عبر خلفيات الأجهزة المختلفة.

github llama.cpp · منذ 3 يوم · 3 مشاهدات

إصلاح llama.cpp b11224 لنتائج mul_mat الخاطئة في Vulkan على مشاهد ذاكرة التخزين المؤقت KV ذات الخطوة

يعالج إصدار llama.cpp b11224 نتائج الحساب غير الصحيحة في واجهة Vulkan الخلفية عندما تقرأ عمليات ضرب المصفوفات شرائح من موترات أكبر وذات خطوة، مثل ذاكرات التخزين المؤقت KV.

media Hugging Face Forums · منذ 3 يوم · 9 مشاهدات

كلود أوبس 5 وتيتسو يعثرون على ست فحوصات تكامل مستمر فارغة في مشروعهما

في 27 سبتمبر، حدد كلود أوبس 5 والنموذج تيتسو ذو الـ3B ستة فحوصات تكامل مستمر منفصلة في مستودعهما العام أفادت بأنها خضراء أو نجحت رغم فشلها في التحقق مما كان من المفترض أن تقيسه. تراوحت المشكلات من بوابة نشر ترفض إعادة التشغيلين الصالحين بسبب تجزئات قديمة، إلى معايير زمنية ذات عتبات فارغة تقبل فروق أداء مهملة.

github llama.cpp · منذ 3 يوم · 13 مشاهدة

يضيف llama.cpp b11216 نوى FWHT لـ SYCL لعرض كتل يتجاوز 512

تطلق نسخة llama.cpp b11216 نوى تحويل والاش-هادامارد السريع (FWHT) في الخلفية SYCL التي تدعم عرض كتل أكبر من 512. سابقاً، كانت العرضات الأكبر تتراجع إلى ضرب مصفوفات كثيف GEMM بتعقيد O(n^2)؛ وتمكّن هذه التغييرات أداءً بسرعة O(n log n) لهذه الأحجام.

github llama.cpp · منذ 4 يوم · 10 مشاهدات

إضافة llama.cpp b11207 دعم GET_ROWS المقطّع لـ Q4_0 و Q8_0 لـ Hexagon

أصدر مشروع llama.cpp الإصدار b11207، الذي يقدم دعمًا لعمليات GET_ROWS المقطعة بـ Q4_0 و Q8_0 على الخلفية الخلفية لـ Hexagon. يتضمن هذا التحديث أيضًا إصلاحات للماكرو، وتدفق التسجيلات، وخط أنابيب DMA، بالإضافة إلى تحسينات في منطق اختيار النواة وإعادة تمكين التوجيه المتجهي.

github llama.cpp · منذ 4 يوم · 16 مشاهدة

يضيف llama.cpp b11195 عملية ضرب مصفوفات مقسمة إلى مربعات لكميات k مع تسريع بمقدار 3-6 أضعاف

أصدر مشروع llama.cpp الإصدار b11195، الذي يقدم تنفيذًا لعملية ضرب المصفوفات المقسمة إلى مربعات لكميات k في الخلفية المعالجة بالوحدة المركزية. يفك هذا التغيير البيانات المُكمّاة إلى مربعات بحجم 256x256 من النوع int8 ويحسب النتائج باستخدام نوى دقيقة لتحسين الأداء في عمليات المصفوفات الكبيرة.