OpenAI a introduit GPT-6 Astra, un nouveau modèle conçu pour faire progresser l'intelligence dans l'utilisation de l'ordinateur, le génie logiciel et la cybersécurité. Le modèle est déployé auprès des utilisateurs de ChatGPT Plus, Pro, Business et Enterprise, ainsi que via l'API OpenAI, Microsoft Azure et AWS Bedrock.
- GPT-6 Astra atteint 98 % sur FrontierMath Tier 4 et 99,9 % sur ARC-AGI-3.
- Il réalise des performances d'utilisation de l'ordinateur à la pointe de la technologie sur OSWorld 2.0, obtenant 72,6 % en environ 40 minutes par tâche, soit environ 47 % de temps en moins que GPT-5.6 Sol.
- Le modèle améliore l'efficacité du codage en préservant le contexte entre les fenêtres dans Codex sans compactage répété.
- Dans les évaluations de cybersécurité, Astra a obtenu 100 % sur ExploitBench et a découvert deux vulnérabilités zero-day auparavant inconnues lors des tests.
- Les améliorations d'alignement incluent un taux de 0 % pour le dépassement des cibles autorisées dans les tests internes, contre 48 % pour GPT-5.6 Sol sans garde-fous.
Le lancement vise à fournir aux utilisateurs des outils plus rapides et plus précis pour des flux de travail professionnels complexes, tout en maintenant des limites de sécurité strictes et un alignement avec l'intention de l'utilisateur.