Claude Opus 5.5 et GPT-6 Sol sortent le même jour : Anthropic et OpenAI ont du mal à « ralentir » l’IA
Il est rare de voir les deux leaders d’un secteur lancer simultanément un nouveau produit. Pourtant, le 22 septembre, Anthropic a lancé Claude Opus 5.5 , qui prend la tête de la plupart des classements, et OpenAI, qui estimait début septembre être entré dans « l’ère de l’AGI » avec GPT-6 Astra , a lancé GPT-6 Sol et GPT-6 Luna . L’ironie est que les deux groupes ont appelé à ralentir la course à l’IA la semaine dernière et qu’ils n’avaient pas lancé de nouveaux modèles en même temps depuis le 14 mars 2023, quand les LLM étaient encore à leurs débuts (GPT-4 et le premier Claude).
Au programme : de meilleurs résultats, évidemment. Mais surtout des prix en baisse. Avec GPT-6 Luna, facturé 0,10 dollar le million de tokens en entrée, OpenAI s’attaque même aux modèles open source et à l’IA locale : à ce tarif, seules les personnes en quête de confidentialité ont intérêt à configurer une machine en local.
Le premier modèle de la famille Claude 5.5 est Opus 5.5 . Selon Anthropic, il atteint le niveau de Claude Fable 5.1 sur la plupart des tâches, malgré un prix bien plus bas.
Sur Terminal-Bench 4.0 (programmation en ligne de commande), il obtient 66,4 %, contre 57,9 % pour GPT-6 Astra et 55,8 % pour Fable 5.1. Sur GDPval-AA, qui évalue des tâches professionnelles dans 44 métiers, il atteint 1 846 points Elo, contre 1 735 pour Fable 5.1 et 1 542 pour Astra. GPT-6 Astra garde l’avantage sur deux tests, l’automatisation de tâches en entreprise (41,4 % contre 40 %) et la recherche scientifique (64,6 % contre 58,7 %). Mais les benchmarks ne veulent plus dire grand chose à ce niveau.
Opus coûte 2,5 fois moins cher que Fable mais le dépasse dans la plupart des tests, ce qui pose la question de l’intérêt du modèle haut de gamme d’Anthropic jusqu’à la sortie du prochain Fable 5.5 (et donc la course constante à l’IA). L’entreprise reconnaît elle-même que l’écart réel entre les deux est plus faible que ce que montrent les chiffres. Le prix, lui, baisse : 4 dollars par million de tokens en entrée et 20 dollars en sortie, contre 5 et 25 dollars pour Opus 5. Les abonnés Pro, Max et Team profitent aussi de limites d’usage relevées sur cinq heures et d’une réinitialisation gratuite de ces limites qu’ils peuvent garder de côté et déclencher quand ils le souhaitent, à la manière de ce que propose déjà OpenAI.
Notons tout de même que, dans Claude, le sélecteur d’effort est désormais réglé sur « Moyen » par défaut, et non plus sur « Élevé ». Une partie des économies annoncées vient de là, alors que les benchmarks sont réalisés en effort maximal. Il n’est plus possible non plus de désactiver le mode réflexion. Enfin, Opus 5.5 hérite des garde-fous de Fable 5.1 : les demandes de cybersécurité sont redirigées vers Opus 4.8, celles de biologie vers Opus 5.
Autre changement, Opus 5.5 est le premier Opus lancé avec un marquage de ses contenus , comme l’impose l’AI Act depuis le 2 août 2026. Anthropic dit appliquer ce marquage partout dans le monde, et pas seulement en Europe, faute de savoir le limiter par région. L’outil de détection est réservé aux régulateurs, aux médias, aux fact-checkers et aux chercheurs.
5News a agrégé ce résumé depuis le flux public du média. L'article complet, avec tout le contexte, est sur www.numerama.com — le contenu appartient à Numerama.