أضاف مشروع llama.cpp دعمًا لفك التشفير التخميني (speculative decoding) الخاص بـ DFlash مع نموذج HunyuanOCR من خلال كشف موترات إدخال الطبقة في الرسم البياني المستهدف. يسمح هذا التغيير لنموذج المسودة بقراءة تدفقات الباقي، مما يتيح تنفيذ طلبات الصور بنجاح بمعدل قبول مسودة يبلغ حوالي 0.5 وإخراج OCR مطابق تمامًا للبايت مقارنة بالعمليات غير التخمينية.
كما يصلح التحديث تحويل مسودة DFlash ضد أهداف HunYuan، مما يحل فشلين محددين: خطأ AttributeError ناتج عن معالجة المفردات غير المرتبطة والبحث في التكوينات الذي يقرأ بشكل خاطئ معاملات المسودة بدلاً من تكوينات الهدف. تضمن هذه الإصلاحات نجاح تحويل مسودات tencent/HunyuanOCR DFlash لكل من نقاط التفتيش الإصدار 1.5 وv1.0 دون تغيير تحويلات النموذج الأساسي.
تُمكّن هذه التغييرات فك التشفير التخميني الفعال للنماذج المستندة إلى Hunyuan في llama.cpp، مما يحسن سرعة الاستدلال مع الحفاظ على دقة المخرجات.