Aller au contenu principal
IA Générative & Agents

Claude Opus 5.5 : la puissance du haut de gamme, 20 % moins cher

Anthropic lance Claude Opus 5.5, plus rapide et 20 % moins cher, au niveau de Claude Fable 5.1 sur la plupart des tâches. OpenAI réplique en divisant par deux GPT-6 Sol.

Gauthier PainteauxGauthier PainteauxPublié le 23 septembre 20268 min
Résumer cet article avec une IA

L'essentiel en deux minutes

Le 12 septembre, le patron d'Anthropic demandait à toute l'industrie de l'IA de lever le pied. Dix jours plus tard, le 22 septembre 2026, son entreprise sort Claude Opus 5.5. Et dans la foulée, le même jour, OpenAI riposte en divisant par deux le prix de GPT-6 Sol. Voilà pour le ralentissement.

Si vous utilisez Claude ou ChatGPT au bureau comme à la maison, cette journée vous concerne directement. La bataille ne se joue plus seulement sur « quelle IA est la plus intelligente », mais sur combien coûte chaque réponse. Et pour une fois, c'est l'utilisateur qui gagne.

Claude Opus 5.5 : ce qui change concrètement

Opus 5.5 est la nouvelle version du modèle professionnel d'Anthropic, l'entreprise américaine qui développe Claude. D'après l'annonce officielle d'Anthropic, il est disponible dès maintenant sur les abonnements payants Pro, Max, Team et Enterprise, ainsi que chez les grands fournisseurs de cloud (Amazon Web Services, Google Cloud, Microsoft Azure). Anthropic en profite pour relever les limites d'usage sur cinq heures de ces formules.

Le message tient en trois chiffres. Le modèle est 20 % moins cher au tarif affiché, il génère ses réponses plus de 30 % plus vite, et sur des usages courants, la facture totale baisse d'environ 40 % par rapport à Opus 5, selon les tests de l'éditeur. Pour un utilisateur, cela se traduit simplement : le même budget fait davantage de travail.

Anthropic met aussi en avant la sécurité. Sur son audit comportemental automatisé, le test d'alignement le plus complet qu'il mène, Opus 5.5 obtient le meilleur résultat de tous ses modèles. Et dans une nouvelle évaluation, il tente de franchir les limites qu'on lui impose environ 85 % moins souvent qu'Opus 5. Des chiffres issus des tests internes de l'éditeur, à lire comme tels.

Face à Claude Opus 5 : même famille, facture allégée

Opus 5.5 succède directement à Claude Opus 5. Le changement le plus visible est tarifaire. Les IA se facturent au « token », un petit morceau de mot : Opus 5 coûtait 5 dollars le million de tokens envoyés et 25 dollars le million de tokens générés. Opus 5.5 descend à 4 et 20 dollars. Et la relecture de contenus déjà traités (le « cache ») passe de 0,50 à 0,20 dollar, soit 60 % de moins.

Côté performances, le saut est net. Sur Terminal-Bench 4.0, un test qui mesure la capacité d'une IA à mener des tâches informatiques de bout en bout, Opus 5.5 obtient 66,4 % contre 52,3 % pour Opus 5. Sur sa déclinaison scientifique, Terminal-Bench-Science, le score double presque, de 29 % à 58,7 %. Et sur GDPval-AA, un classement qui compare les modèles sur des tâches de travail réelles, il grimpe de 1708 à 1846 points.

Graphique comparant Claude Opus 5 et Claude Opus 5.5 : prix en entrée de 5 à 4 dollars, en sortie de 25 à 20 dollars, lecture en cache de 0,50 à 0,20 dollar par million de tokens, score Terminal-Bench 4.0 de 52,3 % à 66,4 %

Face à Claude Fable 5.1 : le haut de gamme presque rattrapé

Chez Anthropic, le sommet de la gamme reste Claude Fable 5.1, sorti en septembre 2026. Il coûte 10 dollars le million de tokens en entrée et 50 en sortie, selon l'annonce officielle de Fable 5.1. Son jumeau Mythos 5.1, le même modèle avec des garde-fous plus souples, reste réservé à des professionnels vérifiés de la cybersécurité et des sciences du vivant.

Opus 5.5, deux fois et demie moins cher, vient chatouiller ce haut de gamme. Anthropic affirme qu'il se hisse au niveau de Fable 5.1 sur la plupart des tâches, et le devance même sur Terminal-Bench 4.0 : 66,4 % contre 55,8 %. L'éditeur cite un exemple parlant : la conversion d'un vieux logiciel réseau vers un langage plus moderne, bouclée en 9 heures et demie par Opus 5.5, contre 12 heures pour Fable 5.1.

Graphique Terminal-Bench 4.0 du score en pourcentage selon le coût par tentative et le niveau d'effort : Claude Opus 5.5 culmine à environ 66 % pour moins de 8 dollars, au-dessus de GPT-6 Astra (environ 58 %), de Fable 5.1 (environ 56 % à près de 20 dollars), d'Opus 5 et de GPT-5.6 Sol
Score au benchmark Terminal-Bench 4.0 selon le coût par tentative (échelle logarithmique). Source : Anthropic.

La presse invite cependant à la nuance. Le site américain MacRumors parle d'un niveau comparable sur la plupart des tâches, avec une avance sur quelques tests précis, quand le site spécialisé eMarketerz le juge légèrement en retrait sur l'ensemble. Retenez ceci : Opus 5.5 ne remplace pas Fable 5.1. C'est le modèle de travail du quotidien qui se rapproche du modèle d'élite, pour bien moins cher.

Face à GPT-6 Sol : la riposte d'OpenAI dans la foulée

OpenAI, l'éditeur de ChatGPT, n'a pas attendu. Le jour même, comme le rapporte le site d'information tech Next, l'entreprise a lancé GPT-6 Sol et GPT-6 Luna, facturés moitié moins cher que la génération précédente, GPT-5.6, ce que confirme le média américain TechCrunch. Concrètement, GPT-6 Sol passe à 2 dollars le million de tokens en entrée et 10 en sortie, contre 4 et 20 pour GPT-5.6 Sol. Luna, la plus abordable des deux, tombe à 0,10 et 0,50 dollar.

Sur le papier, GPT-6 Sol est donc deux fois moins cher qu'Opus 5.5. Et les deux modèles occupent une place comparable : juste sous le modèle phare de leur éditeur, Fable 5.1 chez Anthropic, GPT-6 Astra chez OpenAI. Un repère chiffré, relevé par Next et par le site américain SiliconANGLE : sur le test AutomationBench, GPT-6 Sol réussit 33,2 % des tâches pour environ 0,27 dollar chacune, et fait mieux que l'ancien Opus 5 (26,9 %). Anthropic, de son côté, annonce 40 % pour Opus 5.5, un score mesuré par Zapier, l'éditeur du test.

Graphique des prix par million de tokens : GPT-6 Sol à 2 et 10 dollars (contre 4 et 20 avant), Claude Opus 5.5 à 4 et 20 dollars (contre 5 et 25), Claude Fable 5.1 inchangé à 10 et 50 dollars

Ce qu'Opus 5.5 sait vraiment faire

Réduire Opus 5.5 à un outil pour développeurs serait une erreur. Sur GDPval-AA, un test du cabinet Artificial Analysis qui mesure le travail professionnel réel dans 44 métiers, il obtient 1 846 points, contre 1 735 pour Fable 5.1 et 1 542 pour GPT-6 Astra, selon les résultats publiés par Anthropic. En finance, sur des dossiers notés par des experts, il couvre 86,6 % des attendus, contre 60,3 % pour Opus 5. Seul bémol : sur AutomationBench, qui enchaîne des tâches dans plusieurs applications métier, GPT-6 Astra garde une courte avance (41,4 % contre 40 %).

Le média américain TechCrunch va dans le même sens : Opus 5.5 réussit plusieurs tâches informelles sur lesquelles Fable échouait, et se montre comparable à Mythos, le modèle à accès restreint d'Anthropic, en biologie et en cybersécurité.

Côté création, les internautes s'en donnent à cœur joie. Les réseaux sociaux regorgent de jeux jouables dans le navigateur, de scènes 3D et d'animations générées à partir d'une simple demande, sans image ni fichier externe. Un modèle pensé pour écrire du code se met ainsi à produire des visuels animés, un terrain longtemps réservé aux outils spécialisés. Le site Gekkode a fait le test : une même scène 3D, un voilier de pêche dans la tempête, demandée à Opus 5.5 et à GPT-6 Sol. Les deux cochent les 13 critères. Opus 5.5 livre la scène la plus riche (deux mâts, embruns, éclairs dans les nuages), mais y passe 38 minutes pour environ 7 dollars, contre 5 minutes et 0,29 dollar pour GPT-6 Sol. Le rendu contre la vitesse : tout le match se résume là.

Discours de prudence, rythme de sprint

Le timing a de quoi faire sourire. Le 12 septembre, Dario Amodei, PDG d'Anthropic, publiait un essai intitulé « We Must Pace the Frontier », appelant le secteur à ralentir le rythme d'amélioration des modèles pour laisser la sécurité suivre. Dix jours plus tard, son entreprise publie un modèle plus rapide et moins cher, et son principal concurrent répond dans la foulée.

Il n'y a pas forcément contradiction : Opus 5.5 ne détrône pas le haut de gamme, il rend le niveau professionnel plus accessible. Mais le signal est clair, et le média MCETV le résume en une expression : une bataille des prix qui s'intensifie. Les géants de l'IA ne se battent plus seulement sur l'intelligence brute, mais sur le coût de chaque réponse.

Ce que ça change pour vous

Vous payez un abonnement Claude ? Opus 5.5 est inclus dans votre formule, avec des réponses plus rapides et des limites d'usage relevées. Vous utilisez ChatGPT ? La baisse de GPT-6 Sol profite surtout aux entreprises qui branchent l'IA dans leurs propres outils, mais elle tire tout le marché vers le bas.

Pour une équipe qui fait tourner des assistants IA tous les jours, la question n'est plus « lequel est le meilleur », mais « lequel pour quelle tâche ». Un modèle économique pour les demandes simples, un modèle professionnel pour les dossiers longs, un modèle d'élite pour les cas critiques. Avec deux baisses de prix le même jour, revoir ses choix de modèles devient un réflexe payant.

Pour aller plus loin


Plus d'articles sur IA Générative & Agents

Décryptages, retours de terrain et modes d'emploi : ce que l'équipe apprend en livrant des projets, remis au propre.

Qu'est-ce que Jev, le modèle de décision de TypeSafe AI ?
IA Générative & Agents21 septembre 202613 min

Qu'est-ce que Jev, le modèle de décision de TypeSafe AI ?

Le 15 septembre 2026, TypeSafe AI a lancé Jev, premier « System One Model » : un modèle d'IA qui ne génère pas de texte mais rend des décisions typées, chacune avec un score de confiance. Ce qui change, ce qu'il permet et ses limites.

Eliott Bidault-HervouetEliott Bidault-Hervouet
GPT-6 Astra : le modèle le plus intelligent et le mieux aligné au monde
IA Générative & Agents4 septembre 20268 min

GPT-6 Astra : le modèle le plus intelligent et le mieux aligné au monde

OpenAI lance GPT-6 Astra : benchmarks records, alignement inédit, prix identique à Claude Fable 5.1. Chiffres vérifiés, forces, limites et vrai coût par tâche.

Evan PluchartEvan Pluchart
Fable 5.1 face à GPT-5.6 : le coût ne suffit pas à décider
IA Générative & Agents2 septembre 202613 min

Fable 5.1 face à GPT-5.6 : le coût ne suffit pas à décider

Comparez Claude Fable 5.1, Mythos 5.1, GPT-5.6 et DeepSeek. Choisissez selon vos tâches, votre budget et vos risques, puis lancez un test métier mesurable.

Evan PluchartEvan Pluchart

Combien coûterait votre projet ? Estimation gratuite

Décrivez votre besoin, nous revenons vers vous sous 24h avec une fourchette de budget et de délai.

Réponse sous 24h, sans engagement.

Alexandre Da Silva, Koul, à son poste de travail
Questions fréquentes

Le blog Koul

Ligne éditoriale, sources, usage : ce qui sort sur ce blog et comment vous pouvez vous en servir.

Votre question est plus complexe ?

Un échange court suffit souvent à trancher. Prenez un créneau, on vous répond sur votre cas.

Réserver un créneau