El artículo presenta un diseño de estudio para "ejercicios", que son pequeños ejercicios ejecutables adjuntos a las habilidades del agente. Estos ejercicios verifican que una habilidad funciona correctamente contra el sustrato en vivo en lugar de depender de documentación estática.

  • Los ejercicios se ejecutan contra APIs y entornos reales para asegurar que la habilidad coincida con la realidad actual.
  • Un ejercicio aprobado confirma que la habilidad funciona; uno fallido indica que el sistema subyacente ha cambiado.
  • Las omisiones activan automáticamente actualizaciones al manual de habilidades, asegurando que se mantenga afilado.
  • Los nuevos agentes deben aprobar estos ejercicios para obtener habilidades, demostrando capacidad mediante la ejecución en lugar de la lectura.

Este enfoque asegura que las capacidades del agente permanezcan válidas y actualizadas mediante pruebas continuas contra entornos en vivo.