OpenAI a publié GPT-6.1 Sol, une mise à niveau de GPT-6 Sol qui égale presque l'intelligence de GPT-6 Astra en matière de codage agentique et de travail professionnel, tout en coûtant environ un cinquième des prix standard des tokens d'entrée et de sortie d'Astra.
- Sur DeepSWE v1.1, il égale GPT-6 Astra à environ un cinquième du coût, dépassant GPT-6 Sol de 6,4 points de pourcentage.
- Sur GDP.pdf, il obtient un score supérieur à Opus 5.5 avec des solutions de repli à moins de la moitié du coût par tâche et approche les performances d'Astra.
- Sur AutomationBench, il affiche un score de 2,2 points de pourcentage au-dessus d'Opus 5.5 avec un effort de raisonnement moyen, à environ un tiers du coût.
- Sur OSWorld 2.0, il surpasse GPT-6 Sol de sept points de pourcentage et se rapproche des performances d'Astra à un septième du coût.
- Sur Terminal-Bench Science 0.1, il double plus que le score de GPT-6 Sol avec un effort de raisonnement maximal, à moins de la moitié du coût par tâche.
- Il réduit les erreurs factuelles sur les invites difficiles d'environ 32 % par rapport à GPT-6 Sol avec un faible effort de raisonnement.
Le modèle est disponible dès aujourd'hui pour les utilisateurs Plus, Pro, Business, Enterprise et Edu dans ChatGPT Work et Codex, ainsi que via l'API OpenAI sous le nom gpt-6.1-sol.