OpenAI lance une préversion d'Ultrafast, un nouveau niveau de service qui exécute le modèle GPT-5.6 Sol jusqu'à 14 fois plus vite que le traitement standard. Alimenté par du matériel Cerebras, ce mode génère jusqu'à 750 tokens de sortie par seconde et est initialement disponible via l'API OpenAI.
Le service cible les flux de travail sensibles au temps où l'intelligence en temps réel est critique, notamment :
- Réponse aux incidents et fiabilité pour analyser les journaux pendant les pannes.
- Recherche financière et sécurité pour évaluer les signaux de marché changeants.
- Support client et voix pour résoudre des problèmes complexes sans interrompre les conversations.
- Applications commerciales comme les recommandations personnalisées et l'assistance au paiement.
- Recherche et expérimentation en direct pour permettre des sessions de travail interactives.
OpenAI affirme qu'Ultrafast permet aux entreprises de construire des produits plus réactifs et de prendre des décisions plus rapides en apportant une intelligence de pointe dans des flux de travail exigeants sans sacrifier la vitesse.