Este artículo describe el Stack MIGHT (Modelo, Inferencia, Pasarelas, Arnés, Herramientas), una arquitectura modular que permite a los desarrolladores aprovechar modelos de código abierto para software agéntico sin necesidad de conocimientos profundos en aprendizaje automático ni hardware dedicado.

  • La capa de Modelo actúa como el componente de inteligencia, con modelos grandes como Kimi K3 adecuados para razonamiento complejo y modelos pequeños como GLM 5.3 Flash que ofrecen velocidad y eficiencia de costos para tareas específicas.
  • Los proveedores de inferencia alojan estos modelos a través de API, permitiendo a los desarrolladores pagar por token y experimentar con diferentes proveedores sin gestionar la infraestructura.
  • Las pasarelas y enrutadores agregan múltiples proveedores de inferencia detrás de una única API, habilitando el cambio fluido entre modelos y backends según el costo o el rendimiento.
  • Los arneses gestionan la interacción entre el usuario, la base de código y el modelo, ejecutando herramientas y comandos decididos por el modelo para realizar el trabajo real.

Esta separación de preocupaciones permite a los desarrolladores experimentar con nuevos modelos rápidamente y personalizar cada capa de su flujo de trabajo de desarrollo de forma independiente.