Mid-Harness mejora la fiabilidad de las acciones del agente terminal mediante el escalado del cómputo en tiempo de prueba
Los investigadores presentan Mid-Harness, un método que muestrea y verifica acciones candidatas en el límite entre el modelo y el arnés para mejorar la fiabilidad de la ejecución en agentes terminales. Este enfoque asigna cómputo en tiempo de prueba verificando múltiples opciones antes de enviar una para su ejecución, manteniendo inalterados el generador y el arnés.