Basis, una empresa de agentes de IA para contables, evaluó a GPT-6 Astra de OpenAI frente a GPT-5.6 Sol en una compleja tarea de libro fiscal con 50 pestañas. La prueba mostró que GPT-6 Astra completó el trabajo en la mitad de tiempo y demostró una comprensión más profunda de la intención del usuario.

  • GPT-6 Astra tardó un 50% menos en terminar el libro de 50 pestañas en comparación con GPT-5.6 Sol.
  • Basis observó aproximadamente una mejora del 20% en las puntuaciones internas de evaluación, impulsada por un mejor reconocimiento de intenciones.
  • El modelo ajusta dinámicamente el cómputo de razonamiento según la dificultad de la tarea mientras mantiene su caché.
  • GPT-6 Astra puede inferir expectativas a partir de un contexto más amplio, reduciendo la necesidad de reglas explícitas.

El ajuste dinámico del razonamiento ayuda a reducir costos y tiempo de respuesta, haciendo que las tareas de larga ejecución sean más económicas para Basis y sus clientes.