Anthropic a lancé Claude Sonnet 5.5 le 28 septembre au même tarif que Sonnet 5, 2 dollars le million de tokens en entrée et 10 en sortie, soit moitié moins que Claude Opus 5.5 (4 et 20 dollars). Sur sa fiche officielle, l'éditeur promet un modèle 30 % plus rapide, qui coûterait « jusqu'à 30 % de moins » par tâche que son prédécesseur.
Les mesures d'Artificial Analysis ne vont pas dans ce sens. Avec 56 points à son Intelligence Index, Sonnet 5.5 signe le deuxième score toutes marques confondues, derrière Opus 5.5 réglé au maximum (58) et à égalité avec ce même Opus en effort xhigh. Pour y parvenir en effort maximal, il produit environ 193 000 tokens de sortie par tâche, la consommation la plus forte jamais relevée par le site, 60 % de plus qu'Opus 5.5. Chaque tâche de l'index revient ainsi à 7,67 dollars, contre 5,98 pour Opus 5.5. Face à Sonnet 5, Artificial Analysis mesure une hausse d'environ 50 % du coût par tâche, à rebours de la promesse d'Anthropic.
GPT-6.1 Sol et Gemini 4 Argon, presque aussi forts pour beaucoup moins cher

Successeur de GPT-6 Sol, GPT-6.1 Sol affiche les mêmes prix d'entrée et de sortie que Sonnet 5.5, avec un cache deux fois moins cher, et obtient 52 points pour 0,72 dollar par tâche. Bridé en effort xhigh, le modèle d'Anthropic retombe lui aussi à 52 points, mais pour 2,75 dollars, près de quatre fois plus. Gemini 4 Argon, pas encore ouvert au public, atteint 53 points pour 1,99 dollar au tarif de lancement de Google, une somme qui doublera à la fin de la promotion. Artificial Analysis relève aussi chez Sonnet 5.5 une précision factuelle de 54 % sur son test AA-Omniscience, loin des 66 % d'Opus 5.5.
Le modèle se rattrape en programmation. Il dépasse Opus 5.5 sur Terminal-Bench 4.0 (64 % contre 60 % selon Artificial Analysis, 70,6 % contre 66,4 % dans la mesure d'Anthropic) et occupe la troisième place du classement WebDev d'Arena (ex-LMArena), derrière Opus 5.5 et GPT-6 Astra. Pour qui paie à l'usage, les efforts moyen et élevé limitent sa facture, sans le rendre moins cher que GPT-6.1 Sol à intelligence égale : Artificial Analysis le place en dehors de la frontière entre intelligence et coût, où d'autres modèles font mieux pour moins cher. Sonnet 5.5 n'entre pas pour autant dans notre classement des IA, qui ne retient qu'un modèle par éditeur. Anthropic annonce Haiku 5.5 « dans les prochaines semaines ».
