Cloudflare a publié Clef et Clef-flash, ses premiers modèles entraînés par l'équipe Workers AI. Il s'agit de modèles de décision qui lisent un état d'entrée et un schéma de questions typées pour retourner une probabilité pour chaque réponse autorisée, plutôt que de générer du texte libre.
- Les deux modèles sont à poids ouverts sous licence Apache 2.0 et compatibles avec l'API Jev de TypeSafe AI.
- Clef est post-entraîné à partir de Qwen3.8-27B, tandis que Clef-flash est basé sur Qwen3.5-9B ; tous deux conservent l'encodeur visuel du modèle de base.
- Les modèles prennent en charge trois types de questions : oui/non, choix et score, avec une inférence utilisant une tête de schéma conjointe pour router les preuves et croiser les champs.
- Sur la suite Decision Index 0.2.1 de Cloudflare, Clef a obtenu le meilleur score sur 7 des 10 benchmarks, surpassant Jev sur BANKING77 (94,20 contre 79,74) et CLINC150+OOS (97,43 contre 89,27).
- La latence médiane est de 209,3 ms pour Clef et de 38,8 ms pour Clef-flash, comparée à 524,1 ms pour Jev.
Cette publication offre une option déployable pour les tâches de prise de décision structurée sur Workers AI ou via auto-hébergement, avec un service futur d'apprentissage par renforcement pour le réglage fin sur des données privées.