SpaceXAI a publié Grok 4.7, un nouveau modèle phare pour le codage, les tâches agentices et le travail sur les connaissances, qui utilise un modèle de base plus grand et une exécution d'apprentissage par renforcement prolongée par rapport à Grok 4.6. Le modèle maintient la même structure tarifaire que son prédécesseur tout en offrant des capacités améliorées en auto-vérification, gestion du contexte long et sécurité.

  • Grok 4.7 dispose d'un nouveau modèle de base non réutilisé depuis Grok 4.6 et d'une exécution RL plus longue pondérée vers les tâches complexes.
  • Il obtient les meilleurs scores sur EEBench (64,0 %) et le Harvey Legal Agent Benchmark (19,6 %), avec des améliorations significatives sur Terminal-Bench 4.0 (38,0 %).
  • Le modèle inclut une nouvelle pile de sauvegarde, ne laissant passer que 3,3 % d'invitations dual-use risquées via HackerBench v0.3.
  • La tarification reste à 2 $ par million de tokens d'entrée et 6 $ par million de tokens de sortie, avec une fenêtre de contexte de 500 000 tokens et la prise en charge des entrées texte/image.

La publication offre aux développeurs une option rentable pour le travail professionnel sur les connaissances et les tâches de codage, disponible via l'API xAI, Cursor, Grok Build, OpenRouter, Vercel et Cloudflare.