Apodex 1.1 introduce un marco para la "capacidad operativa", que permite a los modelos de lenguaje mantener un progreso verificable en objetivos complejos mediante la interacción con archivos, la ejecución de código y el mantenimiento del estado. El sistema logra esto ampliando los entornos ejecutables y entrenando a los agentes para descomponer tareas a largo plazo, delegar trabajo en paralelo y replanificar utilizando un marco de ejecución compartido llamado AgentOS.

  • El escalado de entorno aumenta la diversidad y verificabilidad de los archivos ejecutables, las búsquedas y los entornos de código.
  • El escalado de coordinación agente entrena a los agentes para manejar la descomposición de tareas, la delegación en paralelo y la integración asíncrona de resultados.
  • Apodex 1.1 Mini de 35B parámetros proporciona una versión desplegable localmente que conserva una fuerte capacidad operativa.
  • El modelo alcanza rangos de rendimiento líderes en finanzas, investigación científica, matemáticas, programación y búsqueda a pesar de usar menos parámetros que muchos sistemas de vanguardia.

Estos resultados fundamentan la inteligencia agente en el trabajo útil completado a lo largo del tiempo, avanzando hacia el objetivo de construir un "Solucionador de Carga Pesada" para tareas ambiciosas y de larga duración.