Apodex 1.1 引入了一个“工作能力”框架,使语言模型能够通过文件交互、代码执行和状态维护,在复杂目标上持续取得可验证的进展。该系统通过扩展可执行环境并训练智能体分解长周期任务、委派并行工作以及使用名为 AgentOS 的共享执行工具进行重新规划来实现这一目标。

  • 环境扩展增加了可执行文件、搜索和代码环境的多样性和可验证性。
  • 智能体协调扩展训练智能体处理任务分解、并行委派和异步结果集成。
  • 拥有 35B 参数的 Apodex 1.1 Mini 提供了一个本地可部署版本,保留了强大的工作能力。
  • 尽管使用的参数少于许多前沿系统,该模型在金融、科学研究、数学、编码和搜索方面达到了领先的性能水平。

这些结果将智能体智能建立在随时间完成的有效工作上,推动了为雄心勃勃的长周期任务构建“重型求解器”的目标。