Un développeur a publié un framework expérimental open-source appelé Gear pour explorer l'amélioration récursive (RSI) et cherche les retours de la communauté sur sa conception.
Le framework implémente une boucle itérative où un agent méta examine les traces d'exécution et les résultats d'évaluation pour proposer des modifications aux instructions, outils ou flux de travail de l'agent de tâche. L'implémentation actuelle se concentre sur l'amélioration du harnais de l'agent plutôt que sur l'entraînement direct du modèle, qui reste expérimental.
L'auteur demande spécifiquement des conseils pour garantir que les améliorations se généralisent à de nouvelles tâches sans surapprentissage, des simplifications potentielles de la conception de la boucle et des ressources d'apprentissage pertinentes.