xAI a annoncé Grok-1.5, un nouveau modèle doté de capacités de raisonnement améliorées et d'une fenêtre de contexte allant jusqu'à 128 000 tokens. Le modèle sera disponible pour les premiers testeurs et les utilisateurs existants sur la plateforme 𝕏 dans les jours à venir.
- A obtenu 50,6 % sur le benchmark MATH et 90 % sur GSM8K pour les tâches mathématiques.
- A marqué 74,1 % sur le benchmark HumanEval pour la génération de code.
- Prend en charge une longueur de contexte de 128K tokens, augmentant la capacité mémoire de 16 fois.
- A démontré des résultats parfaits dans les évaluations Needle In A Haystack.
- Construit sur un framework d'entraînement distribué personnalisé utilisant JAX, Rust et Kubernetes.
Le lancement vise à fournir aux utilisateurs des capacités avancées de résolution de problèmes et la capacité de traiter des documents substantiellement plus longs tout en maintenant la précision du respect des instructions.