Claude Opus 5.5 : le challenger qui bouscule GPT-6 Soul et GPT-5.1

Anthropic vient de lâcher Claude Opus 5.5, et le positionnement est clair : des performances qui talonnent GPT-5.1 pour un coût inférieur de 40 % par rapport à l'ancien Opus 5. On est sur du milieu de gamme premium, le genre de modèle qui vient chatouiller ce que sera probablement GPT-6 Soul. Et justement, ça buzz pas mal sur X : la sortie de GPT-6 Soul serait imminente.

Le timing est intéressant. GPT-6 et GPT-5.1 sont sortis plus tôt ce mois-ci, et depuis, GPT-6 domine assez nettement en termes d'intérêt mondial. Les courbes de recherche le montrent sans ambiguïté : GPT-6 écrase GPT-5.1 en popularité. Mais ces modèles-là, c'est le haut du panier, l'ultra-frontier comme on dit. Opus 5.5, lui, joue dans une autre catégorie, celle des modèles intermédiaires, face à ce que sera GPT-6 Soul. La bataille s'annonce serrée.

Les benchmarks : ce qui change vraiment avec Opus 5.5

Si on regarde les chiffres d'Artificial Analysis, Opus 5.5 surclasse GPT-5.1 sur le benchmark d'intelligence générale. C'est pas un petit écart, c'est significatif. Mais c'est en zoomant sur les sous-catégories qu'on comprend où Anthropic a concentré ses efforts.

Travail de connaissance et coding

Le gros de l'amélioration se situe sur le travail de connaissance (knowledge work) et le coding. Sur le business workflow, le gain est plus modeste. En revanche, là où ça devient vraiment intéressant, c'est sur le computer use. C'était historiquement un point fort des modèles Gemini, qui étaient bien plus précis et fiables qu'Opus sur ce terrain. Avec cette version 5.5, l'écart se réduit considérablement. Les scores grimpent nettement par rapport à Opus 5 sur tous les benchmarks liés à l'utilisation d'ordinateur.

La question du niveau d'effort en coding agentique

Un détail qui m'a fait tiquer dans les benchmarks : le niveau d'effort ne produit pas les résultats auxquels on s'attendrait. Pour l'agentic coding, Opus 5.5 obtient un meilleur score d'intelligence en effort moyen qu'en effort élevé ou très élevé. C'est contre-intuitif, mais c'est exactement le même phénomène qu'on observe avec GPT-5.1. En effort bas, l'index d'intelligence monte. En effort medium, Opus 5.5 parvient même à battre GPT-6 Astra sur le coding.

Pour le terminal coding agent, le sweet spot se situe entre medium et high. Dans les deux cas, le score d'intelligence dépasse celui des autres modèles. La logique voudrait qu'on pousse tout au maximum, mais les données montrent que ce n'est pas la stratégie optimale. Ça mérite d'être creusé.

Business workflow et connaissance du monde réel

Sur le business workflow, GPT-6 Astra garde l'avantage en effort maximum. Opus 5.5 rattrape son retard, mais la domination de GPT-6 reste nette sur ce terrain. Pour la connaissance du monde réel, c'est le même schéma : plus on monte en effort, meilleurs sont les résultats, et GPT-6 Astra conserve sa longueur d'avance.

La communication : le vrai changement qui compte

C'est peut-être l'amélioration la plus concrète pour l'utilisateur quotidien. Anthropic a bossé sur le style de réponse d'Opus 5.5, et le résultat est flagrant. Les sorties sont désormais plus naturelles et plus faciles à suivre.

J'avais d'ailleurs fait une vidéo sur ce problème : les modèles précédents avaient tendance à générer des réponses longues, denses, difficiles à digérer. Le genre de pavé qui te force à relire trois fois la même phrase pour comprendre où l'IA veut en venir.

La comparaison côte à côte qu'Anthropic fournit est parlante. À gauche, une réponse d'Opus 5 : longue, alambiquée, un mur de texte. À droite, Opus 5.5 : plus courte, structurée, lisible. Tu peux la parcourir et comprendre l'essentiel en quelques secondes. C'est un changement de philosophie dans la façon dont le modèle communique, pas juste un ajustement cosmétique.

Ce gain de clarté change l'expérience utilisateur. Un modèle plus intelligent mais illisible, ça reste frustrant à utiliser au quotidien. Anthropic semble l'avoir compris.

Ce que ça signifie pour la concurrence

Le positionnement d'Opus 5.5 est malin. Anthropic ne cherche pas à détrôner GPT-6 Astra sur le ultra haut de gamme. Ils visent le segment en dessous, celui où le rapport performance-prix devient déterminant. Avec 40 % de réduction de coût par rapport à Opus 5 et des perfs qui rivalisent avec GPT-5.1, la proposition de valeur est solide.

Et puis il y a l'éléphant dans la pièce : GPT-6 Soul. Tout le monde l'attend, les rumeurs s'intensifient sur X, et mon pronostic c'est qu'il sort très bientôt. La question n'est pas de savoir si, mais quand. Et quand il sortira, la comparaison avec Opus 5.5 sera inévitable. Deux modèles milieu de gamme, deux philosophies, un seul créneau.

D'ailleurs, sur ma chaîne YouTube, j'ai lancé un sondage pour savoir ce que vous voulez que je teste entre ces deux modèles. Coding ? Création d'applications ? Recherche ? Dites-moi en commentaire ce qui vous intéresse le plus, je préparerai les tests en conséquence.

Ce qu'il faut retenir du positionnement d'Opus 5.5

Anthropic joue une carte différente de celle d'OpenAI ou de Google. Ils ne courent pas après la première place sur tous les tableaux. Ils optimisent pour un usage réel : un modèle qui coûte moins cher, qui code bien, qui utilise un ordinateur de façon fiable, et qui s'exprime clairement. C'est pas spectaculaire sur le papier, mais c'est exactement ce dont la plupart des utilisateurs ont besoin.

Le computer use, en particulier, pourrait devenir un différenciateur majeur. Si Opus 5.5 tient ses promesses sur ce terrain, ça ouvre des cas d'usage que les autres modèles peinent à adresser proprement.

Points clés à retenir

  • Opus 5.5 coûte 40 % moins cher qu'Opus 5 avec des performances proches de GPT-5.1
  • Gros gains sur le knowledge work et le coding, amélioration notable du computer use par rapport à Opus 5
  • En agentic coding, le niveau d'effort medium donne de meilleurs résultats que high ou extra high, un phénomène aussi observé sur GPT-5.1
  • GPT-6 Astra domine toujours en business workflow et connaissance du monde réel
  • Les réponses du modèle sont plus courtes et plus faciles à suivre, un problème connu des versions précédentes enfin adressé
  • GPT-6 Soul est attendu très prochainement, la comparaison avec Opus 5.5 sera le vrai test

La sortie d'Opus 5.5 n'est pas un coup d'éclat, c'est un coup de précision. Anthropic affine son milieu de gamme au moment où la concurrence s'apprête à faire le même mouvement. Le match contre GPT-6 Soul dira si la stratégie est la bonne.