Deux podiums de hauteur presque identique avec des étiquettes de prix très différentes, illustrant le choix entre Claude Opus 5.5 et Sonnet 5.5

Opus 5.5 ou Sonnet 5.5 : deux points d’écart, deux fois le prix

Deux points sur 1 846 : voilà ce qui sépare Claude Opus 5.5 de Claude Sonnet 5.5 sur le classement de travail de bureau qu’Anthropic met en avant. Les deux modèles de la nouvelle famille 5.5 sont sortis à six jours d’écart, Opus le 22 septembre et Sonnet le 28. Le premier coûte 4 dollars le million de jetons en entrée et 20 en sortie, le second exactement la moitié.

Tous deux déclassent au passage Fable 5.1, le modèle phare de la maison lancé début septembre, dont nous écrivions déjà qu’Anthropic le déconseillait sur la plupart des usages. Reste à savoir lequel des deux choisir, et à lire trois réserves que les communiqués ne mettent pas en avant.

Fable 5.1 déclassé en trois semaines

Sur la fiche d’Anthropic, Opus 5.5 atteint 66,4 % sur Terminal-Bench 4.0, qui mesure la capacité à mener seul une tâche de développement dans un terminal, contre 55,8 % pour Fable 5.1 et 57,9 % pour GPT-6 Astra, le haut de gamme d’OpenAI. Sur GDPval, qui met les modèles en concurrence sur des livrables de bureau réels (notes, analyses, tableaux), il obtient 1 846 points contre 1 735 pour Fable.

Le tout pour un prix au jeton inférieur de 60 % à celui de Fable 5.1, facturé 10 et 50 dollars. La lecture de cache, cette ligne qui s’applique chaque fois qu’un agent relit ses instructions ou une base documentaire, tombe à 0,20 dollar sur les deux nouveaux modèles. Anthropic annonce aussi une génération plus rapide de plus de 30 % par rapport à la génération précédente, et la fenêtre de contexte reste à un million de jetons.

Gamme Claude · septembre 2026
Le prix baisse, le niveau ne suit pas la même pente
Scores publiés par Anthropic, prix en dollars par million de jetons
ModèleTravail de bureauclassement GDPvalCode en autonomieTerminal-Bench 4.0Prixentrée / sortie
Fable 5.1Sorti le 1er sept.1 735 pts55,8 %10 $ / 50 $
Opus 5.5Sorti le 22 sept.1 846 pts66,4 %4 $ / 20 $
Sonnet 5.5Sorti le 28 sept.1 844 pts70,6 %2 $ / 10 $
Opus 5Génération précédente1 708 pts52,3 %5 $ / 25 $
Sources : fiches Anthropic Opus 5.5 et Sonnet 5.5, septembre 2026
BGT Consult AI

Sonnet 5.5 colle à Opus 5.5 pour moitié prix

La gamme devait fonctionner comme un escalier : on paie plus cher pour monter d’une marche. Sonnet 5.5, vendu au même prix que Sonnet 5, aplatit la dernière. Il obtient 1 844 points sur GDPval et dépasse même Opus 5.5 sur Terminal-Bench, à 70,6 %.

Le laboratoire d’évaluation indépendant Vals AI, qui teste les modèles sur des tâches métier (finance, fiscalité, juridique, codage médical), arrive au même constat : Sonnet 5.5 se classe deuxième de son indice général, 0,47 point derrière Opus 5.5. Il fait même mieux que lui sur la fiscalité (73,4 % contre 70,5 %) et sur le codage médical (52,9 % contre 49,8 %).

Opus garde de l’avance là où la tâche s’allonge et se complique. Sur FrontierCode, un test de programmation plus exigeant, il devance Sonnet de huit points (54,4 % contre 46,2 %). Les premiers testeurs d’Opus 5.5 citent des chantiers de taille industrielle, comme une migration de 680 000 lignes de code bouclée en moins d’une journée.

Moitié prix au jeton, deux tiers de la facture

Le prix affiché ne dit pas tout. Vals AI a mesuré un coût par test de 20,80 dollars pour Sonnet 5.5 contre 32,77 pour Opus 5.5 : l’écart réel tombe à moins des deux tiers, pas à la moitié. Deux lignes de la grille aident à le comprendre : la lecture de cache coûte le même prix sur les deux modèles, et les deux ne sortent pas de l’usine avec le même réglage, Opus 5.5 en effort moyen, Sonnet 5.5 en effort élevé.

L’effort, c’est le curseur qui décide combien de temps le modèle réfléchit avant de répondre, et donc combien de jetons il facture. Ce même curseur éclaire le « 40 % moins cher » qu’Anthropic promet sur Opus 5.5 : l’éditeur compare les deux modèles à leurs réglages par défaut, soit le nouveau en effort moyen contre Opus 5 en effort élevé. À l’effort maximal, l’écart disparaît : le cabinet de mesure Artificial Analysis relève 5,98 dollars par tâche pour Opus 5.5 contre 5,86 pour Opus 5.

Le réglage maximal pose d’ailleurs un autre problème. Le développeur Simon Willison, qui teste chaque sortie de modèle, a vu Sonnet 5.5 consommer 1,28 dollar de jetons sans rendre de réponse, son budget épuisé avant d’avoir conclu. Il signale le même défaut sur Opus 5.5. Un service qui monte le curseur au maximum « pour être tranquille » paie davantage pour obtenir parfois moins.

Opus pour trancher, Sonnet pour produire

Anthropic suggère lui-même une répartition, et les chiffres la confirment. Sonnet 5.5 est fait pour le travail bien cadré du quotidien, en volume :

  • Rédiger et mettre en forme : synthèses, documents, présentations, tableurs.
  • Corriger et maintenir : bugs identifiés, petites évolutions de code.
  • Répondre vite : assistants internes, support, tri de demandes. Sonnet est classé rapide par Anthropic, et c’est le seul des deux dont on peut couper la réflexion préalable pour des réponses immédiates.

Opus 5.5 garde les tâches longues et ambiguës, où il faut arbitrer sans consigne précise : audit d’une base de code, migration, analyse d’un dossier touffu, agent qui enchaîne des dizaines d’étapes sans supervision.

La plupart des équipes ont intérêt à faire de Sonnet 5.5 le modèle par défaut et à réserver Opus aux chantiers où l’on a mesuré qu’il fait mieux.

Les demandes de cybersécurité repartent vers l’ancienne génération

Première réserve, commune aux deux modèles. Opus 5.5 hérite des garde-fous de Fable 5.1 : l’essentiel des tâches de cybersécurité est redirigé vers Opus 4.8, et les questions sensibles en biologie passent par les mêmes filtres. Sonnet 5.5 est le premier Sonnet à recevoir ce traitement, avec un repli vers Sonnet 5 qu’Anthropic promet visible pour l’utilisateur.

Le filet ratisse large. Sur un banc d’essai consacré à l’exploitation informatique (surveiller des serveurs, diagnostiquer une panne), Vals AI a vu 82,8 % des tâches confiées à Opus 5.5 basculer vers l’ancien modèle. Une équipe informatique qui confie à Claude la lecture de journaux système ou l’analyse d’une alerte travaillera donc souvent avec la génération précédente, sans l’avoir choisi.

Le juridique reste le point faible de la famille

Deuxième réserve, et la plus utile dans un métier réglementé. Sur le test d’agent juridique conçu avec Harvey, éditeur spécialisé du droit, Opus 5.5 plafonne à 3,75 % et Sonnet 5.5 à 2,92 %, entre le 33ᵉ et le 35ᵉ rang sur 70 modèles testés. Vals AI qualifie le travail juridique en autonomie de « point faible » d’Opus 5.5. Opus 5.5 fait aussi moins bien qu’Opus 5 sur le codage médical.

Anthropic le reconnaît à sa manière : à ce niveau, écrit l’éditeur, les écarts de benchmark disent de moins en moins les écarts réels. Un cabinet qui a calé ses usages sur Opus 5, pour de la recherche documentaire juridique ou de la codification d’actes, a tout intérêt à rejouer une dizaine de ses dossiers types sur les deux nouveaux modèles avant de basculer.

Des intégrations à revoir avant de basculer

Troisième réserve, pour les équipes qui appellent Claude par l’API, directement ou depuis un outil d’automatisation. La documentation d’Anthropic liste plusieurs ruptures communes aux deux modèles :

  • Forcer l’appel d’un outil est refusé : les intégrations qui imposent au modèle d’utiliser une fonction précise doivent passer par le mode automatique.
  • Le raisonnement est lié au modèle et à la conversation : modifier les instructions en cours de route peut faire échouer la suite de l’échange.
  • L’ancien outil de pilotage d’ordinateur n’est plus accepté sur l’API Claude et Google Cloud.
  • Les messages entre deux actions arrivent vides par défaut : une application qui les affichait comme indicateurs de progression se tait sans prévenir.

Chaque modèle ajoute sa contrainte. Sur Opus 5.5, la réflexion ne se désactive plus du tout. Sur Sonnet 5.5, toucher aux réglages d’aléa des réponses (la « température ») renvoie une erreur.

Côté abonnements, la bascule est déjà faite

Les abonnés Claude n’ont rien à arbitrer. Sonnet 5.5 est devenu le modèle de l’offre gratuite, Opus 5.5 celui de Claude Code par défaut, réglé en effort moyen, et Anthropic a relevé les plafonds d’usage sur cinq heures des formules Pro, Max, Team et Enterprise facturées au siège. Ce que chaque formule Claude débloque reste valable, en plus généreux.

Le vrai déplacement se joue chez ceux qui paient au jeton. La question n’est plus de savoir quel modèle est le meilleur, mais lequel est le moins cher à qualité suffisante pour chaque usage. Notre sélection des meilleurs modèles pour un usage professionnel le défend depuis des mois. En l’espace de quatre semaines, Anthropic a sorti un modèle phare, puis deux modèles moins chers qui le valent : le haut de gamme ne se vend plus au niveau, il se vend à la tâche.

À lire en ce moment