Anthropic vient de frapper un grand coup. Avec la sortie de Claude Opus 4.6 le 5 février, la startup fondée par d'anciens d'OpenAI ne se contente plus de jouer les challengers, dans le monde du Vibe Coding, elle revendique la première place. Et, les benchmarks lui donnent raison.
Un cerveau plus gros, une mémoire titanesque

Le changement le plus spectaculaire tient en un chiffre : un million de tokens de contexte, disponible en bêta. Concrètement, ça veut dire que Claude peut ingérer l'équivalent de plusieurs livres en une seule conversation sans perdre le fil. Sur le test MRCR v2, qui mesure la capacité à retrouver des informations noyées dans un contexte massif, Opus 4.6 atteint 76 % de précision, là où Sonnet 4.5 plafonnait à 18,5 %. À ce stade, cela tient plus à un changement de dimension que d'une simple mise à jour.
Côté sortie, la limite passe à 128 000 tokens, le double du modèle précédent (4.5). Et surtout, une nouvelle fonctionnalité de « compaction » résume automatiquement les échanges anciens pour permettre des conversations théoriquement infinies. Pour les développeurs qui utilisent Claude comme assistant de code au quotidien, c'est un game-changer sans précédent.
Le roi du code, selon les benchmarks
C'est sur le terrain du développement que Opus 4.6 frappe le plus fort. Sur Terminal-Bench 2.0, le benchmark de référence pour le coding agentique, il décroche 65,4 %. C'est tout simplement le meilleur score de toute l'industrie. Sur GDPval-AA, qui évalue la capacité à accomplir des tâches économiquement utiles, il devance GPT-5.2 de 144 points Elo. Toutefois, OpenAI a sorti le même jour la version 5.3 de ChatGPT pour ne pas se faire distancer plus.

Michael Truell, fondateur de Cursor, l'éditeur de code dopé à l'IA que beaucoup de devs s'arrachent, salue une « ténacité accrue » et une « bien meilleure review de code ». Sarah Sachs chez Notion parle d'un « collaborateur véritablement compétent ».
Comme nous l'écrivions fin janvier, la montée en puissance de Claude ne date pas d'hier. Mais cette version marque un cap notable. Rappelons l'explosion massive sur Reddit, ou la communauté attendait non sans mal la sortie de Sonnet 5. C'était presque ça.
Des agents IA qui bossent en équipe
L'autre nouveauté majeure, c'est la fonction « Agent Teams » : plusieurs agents Claude peuvent désormais travailler en parallèle sur différentes parties d'un même projet. Recherche, code, analyse, chacun son rôle, comme une vraie équipe de devs. C'est encore en preview, mais ça dessine un futur où l'IA ne se contentera plus de répondre à des questions, Opus 4.6 le démontre, elle mémorise, planifie, opère, test et se corrige.

Anthropic pousse aussi Claude dans les outils bureautiques avec Claude in Excel (analyse de tableaux longs) et un tout nouveau Claude in PowerPoint. Apple l'utilise déjà en interne, preuve que même les géants prennent Anthropic au sérieux.
Et le prix dans tout ça ?
Le prix reste inchangé : 5 $/25 $ par million de tokens, c'est le coup de grâce : Anthropic mise sur la fidélisation plutôt que sur la surenchère tarifaire. La riposte immédiate d'Open AI en annonçant GPT-5.3-Codex, est preuve que la pression est bien réelle sur le marché de l'IA.
Dans notre classement des meilleures IA de 2026, Claude occupait déjà une place de choix. Avec Opus 4.6, Anthropic ne cherche plus à rattraper son retard. Elle mène la course, au moins sur le code.




