SpaceXAI a publié Grok 4.6, un modèle de vision et de langage développé en collaboration avec Cursor et optimisé pour les tâches agentic de longue durée. Le modèle est disponible via l'API, Grok Build et Cursor, avec des niveaux de raisonnement ajustables et un support jusqu'à 500 000 tokens d'entrée.
- Architecture : Environ 1,5 trillion de paramètres.
- Entraînement : Pré-entraîné sur des données curatées incluant des données anonymisées d'agents de codage de Cursor, suivi d'un affinage à l'aide de transcriptions générées par Grok 4.5 et d'apprentissage par renforcement sur des tâches agentic.
- Performance : Ex æquo pour la troisième place sur l'indice d'intelligence d'Artificial Analysis (61) et a obtenu un score maximal de 94,9 % sur GPQA Diamond.
- Tarification : 2,00 $/0,50 $/6,00 $ par million de tokens d'entrée/en cache/de sortie, avec un mode rapide disponible à des tarifs plus élevés.
Le modèle vise à offrir une grande capacité pour le codage et le travail sur les connaissances à un coût inférieur à celui de certains modèles concurrents, en tirant parti des données synthétiques et de l'apprentissage par renforcement pour améliorer les performances sur des tâches complexes.