OpenAI dévoile Ultrafast : GPT-5.6 Sol jusqu'à 14 fois plus rapide
OpenAI présente Ultrafast, une preview API propulsée par Cerebras qui promet jusqu'à 750 tokens de sortie par seconde avec GPT-5.6 Sol.

Le 13 août 2026, OpenAI a présenté Ultrafast, un nouveau niveau de service qui fait tourner GPT-5.6 Sol avec une vitesse annoncée jusqu'à 14 fois supérieure au traitement Standard. Le billet officiel le positionne d'abord dans l'API OpenAI, avec l'infrastructure de Cerebras. Il annonce jusqu'à 750 tokens de sortie par seconde.
Le point important pour les développeurs est le statut du produit. Ultrafast n'est pas une nouvelle version de Sol, ni un accès général dans ChatGPT. C'est une preview limitée, réservée à un groupe de clients sélectionnés.
Ultrafast, qu'est-ce qui change vraiment ?
Ultrafast ne change pas le nom du modèle. Ce qui change, c'est le chemin d'inférence. OpenAI présente Cerebras comme le partenaire qui apporte une latence très basse à son modèle le plus avancé. L'objectif est de faire entrer une intelligence de pointe dans des usages où l'attente casse le fil de la conversation ou ralentit une décision.

Le guide des builders consacré à GPT-5.6 décrit Sol, Terra et Luna comme trois modèles distincts. Le billet Ultrafast ne promet pas la même capacité pour Terra ou Luna. À ce stade, le seul modèle explicitement associé au nouveau niveau de service est GPT-5.6 Sol.
| Question | Réponse vérifiable au 14 août 2026 |
|---|---|
| Modèle ciblé | GPT-5.6 Sol |
| Surface annoncée | API OpenAI en premier |
| Accès | Preview limitée, clients sélectionnés |
| Infrastructure | Cerebras |
| Débit publié | Jusqu'à 750 tokens de sortie par seconde |
| Tarif Ultrafast | Non communiqué |
| Terra et Luna | Non annoncés pour Ultrafast |
Accès et prix, la réponse utile pour les développeurs
L'accès n'est pas encore une option publique à activer. La page d'inscription officielle parle d'une capacité limitée et précise qu'OpenAI évaluera l'inclusion selon l'adéquation du cas d'usage et la disponibilité. Cette page sert donc à recevoir des nouvelles, pas à obtenir une clé Ultrafast immédiatement.
Le prix reste lui aussi ouvert. La documentation tarifaire de l'API affiche des grilles pour les modes Standard et Fast. Elle ne présente pas de tarif propre à Ultrafast. Il serait trompeur de reprendre le prix de Fast mode comme celui d'Ultrafast. Les deux noms désignent des niveaux de service que la documentation présente séparément.
Fast mode est le nom donné par OpenAI à l'ancien Priority processing dans sa documentation API. Ultrafast est présenté dans son billet comme un nouveau niveau propulsé par Cerebras. Aucun prix public Ultrafast n'est indiqué dans le billet officiel ni dans le formulaire d'accès.
Le partenaire Cerebras a publié un post X le même jour. Nous l'attribuons à Cerebras, car OpenAI ne publie ni protocole ni mesure indépendante.
Aperçu du mode Ultrafast pour le GPT 5.6 Sol d'@OpenAI, propulsé par Cerebras. GPT-5.6 Sol Ultrafast génère des réponses à raison de 750 tokens par seconde au maximum. C'est bien le modèle GPT-5.6-Sol complet, jusqu'à 14 fois plus rapide que ce même modèle en traitement Standard. Il a terminé Humanity’s Last Exam en 11 h 11, soit près de 7 fois plus vite que Claude Fable 5, avec une précision comparable.Voir le post sur X
Le chiffre 14 fois, une promesse à lire avec précision
OpenAI écrit « jusqu'à 14 fois plus rapide ». Le mot « jusqu'à » compte. Il décrit un plafond annoncé, pas une garantie pour chaque requête. La page ne précise pas le jeu de tests, la longueur des réponses, le niveau de raisonnement, le percentile retenu ni la façon exacte dont le ratio a été calculé.
Le chiffre de 750 tokens par seconde décrit un débit de sortie. Il ne donne pas automatiquement le temps avant le premier token, ni le temps total d'une réponse avec des outils. Une requête longue, un appel externe ou une étape de raisonnement peuvent modifier l'expérience. Il ne faut donc pas traduire 14 fois en « toutes les réponses arriveront 14 fois plus vite ».
Pour comparer Ultrafast à un autre mode, demandez quatre informations distinctes : le temps avant le premier token, le débit de sortie, le coût au million de tokens et la disponibilité réelle. Tant qu'OpenAI ne publie pas ces éléments pour Ultrafast, 14 fois reste un plafond annoncé, pas une promesse universelle.
Les usages visés par OpenAI
Le billet cite des situations où quelques secondes peuvent changer la valeur d'une réponse :
- intervention sur incident, avec lecture de journaux et analyse des changements récents
- recherche financière et sécurité, pendant que les signaux évoluent
- support client et voix, pour résoudre une demande complexe sans interrompre l'échange
- commerce, pour répondre, vérifier un stock et accompagner une décision d'achat
- recherche en direct, avec plusieurs itérations d'une expérience dans la même journée
Ces exemples viennent d'OpenAI et décrivent des scénarios explorés avec ses premiers clients. Ils ne constituent pas une démonstration publique ni un test réalisé par OIA. Pour comprendre où se situe le modèle dans la gamme, notre article sur l'ouverture publique de GPT-5.6 détaille déjà les différences entre Sol, Terra et Luna. Pour les usages grand public, consultez aussi notre dossier sur les alternatives à ChatGPT.
La preview ne donne pas encore de tarif Ultrafast, de quota public, de garantie de latence ou de protocole détaillé pour le chiffre de 14 fois. Elle ne confirme pas non plus un accès dans ChatGPT, ni une extension à Terra ou Luna. Ces points doivent être vérifiés dans une annonce ultérieure avant toute décision d'intégration.
Sources primaires : annonce OpenAI, formulaire d'accès, guide GPT-5.6, documentation des tarifs API.
Questions fréquentes
Ultrafast est-il disponible dans ChatGPT ?
OpenAI l'annonce d'abord pour l'API et décrit une preview limitée. Aucun accès ChatGPT n'est annoncé dans le billet Ultrafast.
Quel modèle utilise Ultrafast ?
GPT-5.6 Sol est le seul modèle nommé dans l'annonce officielle. Terra et Luna ne sont pas annoncés pour ce niveau de service.
Combien coûte Ultrafast ?
Le billet et le formulaire officiels ne publient aucun tarif Ultrafast à la date du 14 août 2026.
Le mode est-il toujours 14 fois plus rapide ?
Non. OpenAI parle d'un maximum allant jusqu'à 14 fois face au traitement Standard et ne publie pas la méthode de mesure complète.


