Le ChatGPT le plus intelligent peut maintenant répondre 14 fois plus vite : à quoi ça sert ?
Le modèle le plus intelligent d’OpenAI vient de gagner un mode turbo. Sauf qu’il n’arrivera pas dans ChatGPT, qu’aucun tarif n’a été annoncé, et qu’une poignée d’entreprises seulement y ont accès.
OpenAI a ouvert le 13 août un aperçu limité d’Ultrafast, un nouveau palier de service de son interface de programmation. Le principe tient en une ligne : le même GPT-5.6 Sol , la même intelligence, mais servi jusqu’à 14 fois plus vite que le traitement standard, soit jusqu’à 750 unités de texte générées chaque seconde . Rien de neuf côté modèle, donc. Tout se joue sur le matériel qui le fait tourner.
Le tour de force vient de Cerebras , un fabricant américain qui grave ses processeurs sur une galette de silicium entière plutôt que de les découper en puces individuelles. Résultat : un modèle complet tient sur un seul composant, au lieu d’être réparti sur des armoires de cartes graphiques qui passent leur temps à s’échanger des données. Ce sont ces allers-retours internes qui créent la latence, cette poignée de secondes entre la question et la réponse. En les supprimant, on gagne du temps sans toucher à la qualité du raisonnement.
La démonstration mise en avant par OpenAI a le mérite d’être parlante. À partir d’une seule consigne écrite, le modèle génère un simulateur d’entrepôt logistique en trois dimensions, l’entreprise faisant tourner l’exercice en parallèle dans les deux modes pour rendre l’écart visible. Produire une application complète n’a rien à voir avec répondre à une question : le modèle écrit du code en continu, et chaque unité de texte gagnée se convertit directement en attente en moins. Précisons tout de même que le facteur 14 reste une mesure maison, sans vérification externe publiée à ce jour.
Launching first in the OpenAI API to a select group of customers with expanded access to more businesses as capacity grows. pic.twitter.com/a5dleofiDJ
Ultrafast démarre côté (API), celle que les développeurs branchent sur leurs propres outils, et l’accès reste réservé à quelques clients le temps que la capacité suive. Parmi les premiers testeurs figurent des maisons de la finance comme Jane Street, mais aussi des acteurs de la relation client et de la comptabilité. OpenAI vise explicitement les métiers où une réponse en retard ne vaut plus rien : réponse aux incidents informatiques, débogage, recherche financière, détection de fraude, support client en temps réel, applications vocales et commerce en ligne. Autrement dit : si vous utilisez ChatGPT ou Codex , vous n’êtes pas concernés .
L’entreprise donne aussi l’exemple de ses propres équipes, ce qui reste la meilleure façon de comprendre l’intérêt. Pendant un incident technique, ses développeurs font analyser en direct les journaux d’activité, les traces et les échanges internes, puis préparer et valider des correctifs, la décision finale restant humaine. Côté recherche, des boucles d’expérimentation qui tournaient toute la nuit permettent désormais plusieurs itérations dans une seule journée de travail. Un testeur résume la bascule à sa manière : la vitesse « change complètement l’expérience d’appel pour le travail complexe » .
Reste la question qui fâche, celle du prix.
5News a agrégé ce résumé depuis le flux public du média. L'article complet, avec tout le contexte, est sur www.01net.com — le contenu appartient à 01net.