OpenAI a présenté GPT-6 Astra comme son modèle le plus intelligent à ce jour tout en exposant sa stratégie de calcul full-stack, qui inclut la nouvelle puce d'inférence Jalapeño. L'entreprise indique que son matériel personnalisé offre un débit de tokens de pointe par watt 1,5 à 1,9 fois supérieur par rapport aux systèmes commerciaux lors des tests InferenceX.

  • GPT-6 Astra est décrit comme l'état de l'art dans l'utilisation informatique, la navigation, l'ingénierie logicielle, la cybersécurité, les sciences et le travail professionnel.
  • La puce d'inférence Jalapeño réduit la latence de bout en bout de 1,7 à 3,6 fois par rapport aux systèmes commerciaux testés.
  • GPT-5.6 Sol a amélioré les logiciels de déploiement en production, réduisant les coûts de service de bout en bout de 20 % et augmentant l'efficacité de génération de tokens de plus de 15 pour cent.
  • L'organisation de recherche d'OpenAI utilise désormais 3,1 jours-agent d'effort pour chaque jour ouvré de travail humain.

Ces avancées visent à réduire le coût et à augmenter la vitesse des tâches d'IA, permettant aux clients d'obtenir plus avec moins d'essais tout en soutenant la croissance d'OpenAI grâce à des flux de revenus diversifiés.