Basis, une entreprise d'agents IA pour comptables, a évalué le GPT-6 Astra d'OpenAI par rapport au GPT-5.6 Sol sur une tâche complexe de classeur fiscal à 50 onglets. Le test a montré que le GPT-6 Astra a terminé le travail en la moitié du temps et a démontré une compréhension plus profonde de l'intention de l'utilisateur.

  • Le GPT-6 Astra a mis 50% moins de temps pour terminer le classeur à 50 onglets par rapport au GPT-5.6 Sol.
  • Basis a observé environ une amélioration de 20% des scores d'évaluation interne, due à une meilleure reconnaissance des intentions.
  • Le modèle ajuste dynamiquement le calcul du raisonnement en fonction de la difficulté de la tâche tout en maintenant son cache.
  • Le GPT-6 Astra peut inférer les attentes à partir d'un contexte plus large, réduisant ainsi le besoin de règles explicites.

L'ajustement dynamique du raisonnement aide à réduire les coûts et le temps de réponse, rendant les tâches de longue durée plus économiques pour Basis et ses clients.