OpenAI a lancé ses modèles o3 et o4-mini, qui combinent des capacités de raisonnement de pointe avec une utilisation complète d'outils, incluant la navigation web, l'exécution de Python et l'analyse d'images. Ces modèles sont entraînés par apprentissage par renforcement à grande échelle sur des chaînes de pensée pour améliorer leur capacité à résoudre des défis complexes en mathématiques, programmation et sciences.

  • Les modèles utilisent des outils dans leur processus de pensée pour augmenter leurs capacités, comme le recadrage d'images ou l'analyse de données via Python.
  • Le groupe consultatif de la sécurité d'OpenAI (Safety Advisory Group) a examiné les modèles selon la Version 2 de son cadre de préparation (Preparedness Framework).
  • Les évaluations ont déterminé qu'aucun des modèles n'atteint le seuil Élevé en capacité biologique et chimique, cybersécurité ou auto-amélioration de l'IA.

Le lancement marque la première sortie sous le cadre mis à jour, la société notant que le raisonnement avancé offre de nouvelles voies pour améliorer la sécurité et la robustesse par un alignement délibératif.