一位开发者发布了名为 Gear 的开源实验性框架,以探索递归自我改进(RSI),并寻求社区对其设计的反馈。

该框架实现了一个迭代循环,其中元代理审查执行轨迹和评估结果,以向任务代理的指令、工具或工作流程提出更改建议。当前的实现侧重于改进代理的运行环境,而非直接进行模型训练,后者仍处于实验阶段。

作者特别请求就确保改进能够泛化到新任务而不过拟合、循环设计的潜在简化以及相关学习资源提供建议。