ينشر رادار النماذج الذكية منهجية لحساب ما إذا كانت 46 نموذجًا مفتوح الأوزان الخاضعة للتتبع تتسع على عتاد محدد، مستبعدةً قواعد الشائعة الشائعة التي قد تنحرف بعوامل أربعة أو أربعين. يحدد الموقع الملاءمة عن طريق جمع أحجام أوزان GGUF المقاسة، وحسابات ذاكرة التخزين المؤقت للسياق من ملفات التكوين، والعبء التشغيلي الإضافي، مع أخذ آليات الانتباه الهجين مثل النوافذ المنزلقة والانتباه متعدد الرؤوس الكامنة في الاعتبار.

  • تُؤخذ الأوزان من الأحجام البايتية المنشورة بدلاً من عدد المعلمات لتجنب أخطاء تقسيم الشرائح.
  • تُحسب ذاكرة التخزين المؤقت للسياق باستخدام أنواع الطبقات (كاملة مقابل نافذة منزلقة) وأبعاد الرؤوس المذكورة صراحةً في ملف config.json.
  • يتم الحفاظ على هامش أمان بنسبة 12% لبطاقات الذاكرة الرسومية القياسية، بينما تستخدم شريحة Apple Silicon 70% من الذاكرة الموحدة بسبب قيود نظام macOS.
  • بالنسبة لبطاقة RTX 3060 بسعة 12 جيجابايت، يُظهر التحليل أن 14 نموذجًا تتسع عند سياق بطول 8K و10 نماذج عند سياق بطول 32K؛ بينما يتطلب Qwen3 14B الإخراج الخارجي حتى عند السياق بطول 8K.

يرفض المؤلفون نشر درجات السرعة أو الجودة، ويركزون حصريًا على بيانات ملاءمة الذاكرة القابلة للتكرار لمساعدة المستخدمين في تحديد توافق العتاد دون التخمين.