Les chercheurs proposent Living-Harness, un agent de harnachement auto-évolutif qui convertit les trajectoires terminées et les signaux d'évaluateur en preuves a posteriori pour des mises à jour bornées du harnachement. Guidé par une Evolution-SOP, le système extrait des abstractions d'épisodes et des preuves de mise à jour structurées pour écrire la mémoire épisodique et les graphes d'état.
- Living-Harness enregistre les conditions de déclenchement, les schémas d'échec et les actions de récupération comme mémoire épisodique.
- Il maintient un graphe d'état de nœuds, de bords de réparation et de règles de transition pour des réparations procédurales.
- L'état du harnachement mis à jour est récupéré pour guider les interactions futures tandis que les outils et le contexte de base restent figés.
- Sur huit environnements interactifs dérivés de τ²-Bench et MultiWOZ-2.4, il améliore la moyenne Pass@1 par rapport au meilleur modèle de référence de 10,07 et 9,91 points de pourcentage respectivement.
L'état du harnachement évolué prend en charge la réutilisation uniquement par récupération à travers les squelettes de modèles, permettant aux réparations procédurales de s'accumuler au fil des cycles d'évolution.