Claude Opus 5.5 : l’élève qui en dit long sur le maître
24 septembre 2026

Depuis lundi soir, mon fil X ressemble à un festival de courts-métrages.
Une goutte de pluie qui traverse un paysage. Un message radio qui met quatorze minutes à arriver de Mars. Un village où tout le monde envoie ses requêtes à Claude, jusqu’au jour où une petite fille lui pose une question : « Qu’est-ce que tu aimes ? »
Derrière ces films, pas de caméra ni de modèle vidéo : du code. Chaque forme, chaque éclairage, écrit sous forme mathématique par une IA qui a pris tout le monde de court. Cette IA, c’est Claude Opus 5.5, sortie par Anthropic le 22 septembre.
Et ce modèle cache un petit mystère. Il est moins cher et plus rapide que son prédécesseur. Et pourtant, sur plusieurs terrains décisifs, il bat le haut de gamme de la maison, Fable 5.1.
Un modèle qui devient meilleur en coûtant moins, ça n’arrive pas par hasard. L’explication la plus solide, à mon sens : Opus 5.5 est un élève, et son maître n’est pas sorti du labo.
(En fin d’article, une petite surprise créée par Opus 5.5 ;) )
Quand le moins cher passe devant
Commençons par l’addition. Au token, Opus 5.5 coûte 20 % de moins qu’Opus 5. Mais surtout, il va plus droit au but, avec un meilleur « goût » pour trouver vite la bonne solution. Au bout du compte, Anthropic chiffre l’économie à environ 40 % sur une charge de travail typique.
Un modèle moins cher, ça doit être moins bon, non ? Eh... Bien non. Voici le tableau publié par Anthropic :

Je ne vais pas vous infliger toutes les lignes. Deux suffisent.
Sur le code autonome, là où l’IA doit mener seule une tâche complète dans un terminal, Opus 5.5 met plus de dix points dans la vue à Fable 5.1, son propre grand frère. Et en recherche scientifique outillée, il double le score d’Opus 5. D’une version à l’autre.
Le classement indépendant d’Artificial Analysis lui donne d’ailleurs la première place de son indice d’intelligence. Le petit dernier, le moins cher de la famille, est aujourd’hui le premier de la classe.
L’hypothèse de l’élève
Reste à comprendre comment c’est possible.
L’hypothèse la plus réaliste est la suivante : un très gros modèle, gardé en interne, a servi de professeur. Plutôt que d’apprendre seulement sur des données brutes, le petit modèle apprend à imiter les réponses et les raisonnements du grand. Il hérite ainsi d’une bonne part de sa compétence pour une fraction de son coût (c’est ce qu’on appelle la « distillation »). Patrick Toulme, ingénieur chez Google, l’écrit sans détour : Opus 5.5 est selon lui « l’artefact » d’un modèle professeur bien plus gros. Anthropic ne l’a pas confirmé.
Si c’est le cas, le modèle que vous utilisez est l’élève. Le maître reste au labo, avec forcément une longueur d’avance. On a déjà vu ce film cette année : Claude Mythos a d’abord vécu en interne et chez une poignée de partenaires, des semaines avant d’arriver chez le grand public.
Et pendant ce temps, le maître travaille.
Le 17 septembre, cinq jours avant la sortie d’Opus 5.5, Anthropic a publié un autre chiffre. En février, Claude menait moins de 1 % de la recherche en IA de l’entreprise. En août : 26 % !
« Mener », ici, veut dire réaliser presque seul une tâche à partir d’une consigne, sous la supervision d’un humain. Un quart de la recherche qui fabrique les prochains Claude est donc désormais menée... par Claude. Environ 30 000 agents y travaillent en permanence.
Anthropic le dit lui-même : ces mesures servent à suivre la distance qui nous sépare de l’« amélioration récursive » (ou RSI pour Recursive Self Improvement), le moment où un modèle construira seul son successeur.
Ces derniers temps, la vitesse de déploiement des meilleurs modèles frontières s’est considérablement raccourcie. Toutes les semaines ou presque, un nouveau modèle bat les précédents. Si le RSI s’enclenche vraiment, il y en aura un nouveau... Tous les jours ? C’est fascinant. Et c’est aussi, pour une bonne partie de la communauté, l’un des principaux mécanismes de perte de contrôle. C’est précisément le genre de mécanisme qui mérite un certain ralentissement (j’en parlais la semaine dernière), mais c’est un autre débat.
Le graphique qui m’a fait tomber de ma chaise
Le tableau aligne les records. Mais c’est ce graphique-là qui en dit le plus :

Chaque point correspond à un niveau d’« effort », c’est-à-dire au temps de réflexion qu’on accorde au modèle avant qu’il agisse. Plus on va vers la droite, plus la tâche coûte cher.
Suivez la courbe orange d’Opus 5.5. En effort moyen, pour moins d’un dollar la tâche, il fait mieux que GPT-6 Astra poussé à fond, qui en coûte plus de quatre ! Honnêtement, c’est ce chiffre qui m’a vraiment fait tomber de ma chaise, et réaliser à quel point Opus 5.5 est un bon modèle.
Depuis sa sortie, j’utilise Opus 5.5 à fond, et la qualité se fait sentir. Ce n’est clairement pas qu’un artefact des évaluations, qui ne se refléterait pas dans l’usage réel. Opus 5.5 travaille vraiment vite et bien, et résout en grande partie les problèmes que posaient Opus 5 (qui était étonnamment "mauvais" pour sa gamme - mais même Anthropic le reconnait et... s’en excuse).
L’œil de l’élève
Reste la question du début : pourquoi tout le monde se met-il soudain à faire des films avec un modèle de langage ?
Parce qu’Opus 5.5 voit mieux. Beaucoup mieux.
Dessiner en code, c’est un peu comme peindre les yeux bandés. On écrit des coordonnées, des courbes, des dégradés, et on ne découvre qu’après coup à quoi ressemble le résultat. Un modèle qui ne sait pas bien regarder son propre rendu produit des formes à peu près justes... et rarement belles.
Opus 5.5, lui, sait regarder (ou en tout cas, mieux que les autres LLM). Il écrit le code, affiche l’image, en prend une capture, l’examine, et corrige au pixel près : un reflet trop fort, une ligne qui dépasse, un personnage qui flotte au-dessus du sol... Puis il recommence. C’est cette boucle (écrire, voir, corriger) qui transforme un dessin approximatif en film.
Ainsi, Opus 5.5 lit mieux les graphiques complexes, il pilote mieux un ordinateur à l’écran (lire une interface, cliquer au bon endroit : le "computer use"), et un testeur cité par Anthropic, qui a fait coder un même jeu vidéo à plusieurs modèles Claude à partir d’une seule consigne, l’a classé premier pour la qualité de ses graphismes et de ses finitions.
Et ça dépasse largement les dessins animés. Un modèle qui voit bien peut comparer une maquette de site à son design, relire un tableau de bord, repérer l’erreur dans un graphique ou piloter un logiciel qui n’a jamais prévu d’être piloté par une IA. Pour tous ceux qui fabriquent des interfaces, des supports ou des visuels, c’est un vrai changement de catégorie.
La surprise : le deeposcope, dessiné par l’élève
Pour finir, j’ai voulu voir cette boucle à l’œuvre. Et j’ai confié à Opus 5.5 un concept que j’ai inventé pour décrire ce que l’IA est en science : le "deeposcope". L’idée que l’IA est un instrument d’observation de l’infiniment complexe, profond, comme le télescope l’a été de l’infiniment grand et le microscope de l’infiniment petit.
La consigne tenait en quelques paragraphes : un court film de gravure animée, entièrement dessiné en code, sans une seule image. 47 minutes plus tard, voici ce qu’il a rendu.
Galilée à Padoue, en 1610. Sa lunette qui se dessine trait par trait, et dedans, Jupiter et ses quatre lunes, qui tournent à leurs vraies vitesses, pendant que la notation de ses carnets se met à jour en direct. Puis la goutte d’eau de Van Leeuwenhoek à Delft, où nagent paramécies et vorticelles. Puis un instrument qui n’existe pas encore, le deeposcope, dans lequel un nuage de points s’organise peu à peu en communautés. Et pour finir, un œil qui s’approche de l’oculaire.
Retrouver la notation de Galilée, faire du champ de Jupiter la goutte d’eau suivante : ces choix-là, il les a faits seul, sans que personne le lui demande. Et il a vérifié chaque acte comme décrit plus haut, capture d’écran après capture d’écran.
Dans le conte de Kevin Ngo, une petite fille demandait à Claude ce qu’il aimait. Je ne sais pas ce qu’aime Opus 5.5. Mais devant ce film, la question ne me paraît plus tout à fait absurde.
Alors, concrètement ?
→ Si vous travaillez avec ces outils, remettez à plat vos réglages. Tout ce qui tournait sur Opus 5 ou Fable peut passer sur Opus 5.5.
→ Confiez-leur des missions entières : un objectif, un contexte, et laissez le modèle construire son propre plan.
→ Testez le visuel. Maquettes, dataviz, animations : très peu de gens ont encore essayé, et c’est là que l’écart se creuse.
→ Et testez à la frontière, dans des systèmes agentiques comme Claude Code, pas dans un chatbot gratuit : vous seriez surpris de l’écart. (Oui, je radote. Mais c’est important.)
Un dernier mot sur le contexte. Opus 5.5 est le premier modèle d’Anthropic depuis que Dario Amodei a appelé à ralentir la course. Ralentir, donc... avec un modèle qui bat son propre haut de gamme. (Il fallait oser.) Pour être juste, Opus 5.5 progresse surtout en efficacité : METR parle d’une progression incrémentale, et il met surtout le niveau de Fable entre les mains de beaucoup plus de monde. C’est une bonne nouvelle.
On attend la réplique d’OpenAI... La semaine prochaine ?