LiquidAI a publié deux nouveaux modèles de décision, d1-3B et d1-omni-600M, qui retournent des réponses typées en un seul passage avant avec zéro token de sortie en lisant directement depuis la distribution du modèle sur les options.
- d1-3B est un modèle multimodal de 3B paramètres construit sur LFM2.5-VL-3B atteignant 48.57 sur l'indice de décision 0.2.1, surpassant des modèles plus grands comme Decider 35B-A3B.
- d1-omni-600M est un modèle de décision de 587M paramètres construit sur LFM2.5-Encoder-350M qui prend en charge les entrées vision-language et audio-language en un seul passage.
- Les deux modèles fonctionnent sans génération ni analyse de texte, d1-3B terminant les décisions en 8 ms sur une NVIDIA RTX 4090.
Ces publications offrent des capacités de prise de décision rapides et de taille pour le bord pour les tâches multimodales.