OpenAI lance « Ultrafast », un mode 14x plus rapide pour GPT-5.6 Sol
Original : OpenAI introduces ‘Ultrafast,’ a new mode that makes GPT-5.6 Sol work at 14x the speed
Pourquoi c'est important
La course à la vitesse d'inférence devient un axe stratégique majeur pour les grands fournisseurs d'IA.
OpenAI a dévoilé le 13 août 2026 un nouveau mode appelé « Ultrafast » pour son modèle GPT-5.6 Sol, capable de générer jusqu'à 750 tokens par seconde, soit 14 fois la vitesse de traitement standard, grâce à un partenariat avec le fabricant de puces Cerebras.
OpenAI a annoncé le lancement en préversion d'« Ultrafast », un nouveau mode d'inférence accélérée pour son modèle phare GPT-5.6 Sol. Selon la société, ce mode peut atteindre 750 tokens de sortie par seconde, soit 14 fois la vitesse de traitement habituelle. « Jusqu'à présent, obtenir une vitesse en temps réel signifiait généralement choisir un modèle plus petit ou plus spécialisé », a déclaré OpenAI dans son billet de blog. « Ultrafast marque une progression dans une nouvelle direction : plus de travail utile par seconde. » Cette capacité est rendue possible grâce au partenariat d'OpenAI avec Cerebras, spécialiste des puces d'accélération IA. OpenAI cible notamment des cas d'usage en entreprise tels que la réponse aux incidents, le service client, l'analyse des marchés financiers et le commerce en ligne. La préversion est actuellement réservée à un groupe restreint de clients, avec une extension prévue au fur et à mesure de la montée en capacité. Le concurrent Anthropic propose également un mode rapide pour Claude, mais sans atteindre les performances annoncées par OpenAI.