أطلقت Hugging Face مكتبة @huggingface/kernels، وهي مكتبة لتحميل وتشغيل نوى WebGPU المحسّنة من Hub الخاص بـ Hugging Face، مع مجموعة أولية تضم 207 نواة. كما يُقدّم هذا الإصدار Fleet، وهو حزمة لمعايرة وحدة المعالجة الرسومية داخل المتصفح تجمع بين أدلة الأداء والدقة من أجهزة المستخدمين.

  • تشمل مجموعة النوى عمليات مثل ضرب المصفوفات وعمليات الانتباه الأساسية، وكل منها نُشر كمستودع مُدرَّج الإصدارات مع ملفات تعريف الارتباط واختبارات الدقة وقوالب WGSL shader.
  • يوفر @huggingface/kernels محمّل JavaScript يقوم بتنزيل وتشغيل النوى مباشرة من Hub باستخدام إصدارات العقود الصريحة.
  • أظهرت نتائج المعايرة على وحدة معالجة رسومية Apple M4 أن النوى الجديدة أسرع بنسبة 2.57x بالمتوسط الهندسي مقارنة بـ ORT WebGPU، مع حالات محددة مثل bilinear Einsum التي تعمل بسرعة تفوق 10,000 مرة.
  • يتيح Fleet للمستخدمين تشغيل الاختبارات على أجهزتهم، مما يساهم بأدلة خاصة لمساعدة تحديد الأعطال وتحسين متغيرات النوى عبر أجهزة متنوعة في العالم الحقيقي.

يهدف هذا الأساس إلى تسهيل استخدام الاستدلال المحلي السريع عبر نظام WebAI البيئي من خلال توفير عقود عمليات مُدرَّجة الإصدارات وبيانات أداء واسعة النطاق وموثقة.