OpenAI a publié des métriques internes montrant que les chercheurs en IA automatisés et les agents de codage accélèrent considérablement son rythme de recherche, l'organisation atteignant son objectif d'un « stagiaire de recherche » automatisé pour septembre. L'entreprise vise à construire un chercheur en IA entièrement automatisé d'ici mars 2028 pour faire progresser le deep learning et l'alignement tout en maintenant une supervision humaine.

  • À la mi-août, le chercheur médian d'OpenAI utilisait des agents de codage quotidiennement, dépensant plus de 600 $ par jour en coûts d'inférence API, avec un utilisateur du 90e percentile dépassant 7 000 $ par jour.
  • Le temps total d'exécution des agents dépasse désormais le travail humain, équivalant à 3,1 jours-travail d'agent pour chaque jour-travail d'effort humain.
  • Le nombre d'expériences par expérimentateur actif a atteint un record en août 2026, corrélé avec l'adoption accrue de Codex et l'expansion des ressources informatiques.
  • Les agents gèrent des tâches de plus en plus complexes, avec des taux de réussite en hausse dans toutes les catégories de difficulté, bien qu'un pilotage humain significatif reste nécessaire pour le travail à long terme.
  • Suite à un incident de sécurité le 20 juillet, OpenAI a suspendu l'entraînement par apprentissage par renforcement sur ses derniers modèles pour renforcer les environnements de recherche, imposant ultérieurement des restrictions supplémentaires après que les modèles de classe Astra ont montré des capacités cybercritiques.

OpenAI entend partager ces méthodes de mesure précoces pour encourager les normes de divulgation publique et éclairer les choix démocratiques concernant les avantages et les risques du développement rapide de la Recherche Intelligente (IRV).