Anthropique a lancé Claude Opus 5.5la nouvelle version de son modèle phare, qui s'accompagne d'améliorations des performances en matière de programmation et de travail de connaissances, en plus d'une réduction de prix de 40 % par rapport à l'Opus 5. La société a annoncé la mise à jour il y a quelques heures via son compte officiel sur X, et le présente comme un saut qui combine plus de puissance avec un coût inférieur pour les développeurs et les utilisateurs d'API.
Dans le secteur de l’intelligence artificielle, il est courant que les entreprises lancent des versions plus performantes de leurs modèles, mais il est moins courant qu’elles réduisent également leurs coûts. L'entreprise assure que Opus 5.5 fonctionne de la même manière que Claude Fable 5.1 dans la plupart des tâches, et cela coûte un 40% de moins exécutez-le que son prédécesseur Opus 5. Parallèlement à l'annonce, Anthropic a publié un graphique avec les améliorations de performances, où de clairs progrès peuvent être vus dans la programmation agentique et dans les emplois qui nécessitent des connaissances générales. Passons en revue les chiffres spécifiques que l'entreprise a partagés.
Les prix des API baissent par million de jetons
Anthropic facture l'utilisation de ses modèles par tokens, unités minimales de texte traitées par l'intelligence artificielle. Avec Opus 5, le traitement d'un million de jetons d'entrée coûte 5 dollarset le départ a été facturé à 25 dollars par million. L'opus 5.5 réduit les deux chiffres à 4 et 20 dollarsrespectivement, l'ajustement qui soutient les 40% d'économies réclamées par l'entreprise.
Pour ceux d’entre vous qui gèrent des agents qui enchaînent des milliers d’appels API ou traitent de gros volumes de documents, cette différence s’ajoute rapidement à votre facture mensuelle. Un flux de travail qui consommait auparavant des centaines de dollars en jetons de sortie voit désormais ces dépenses réduites dans la même proportion que la baisse de prix. Anthropic souligne que cet ajustement profite particulièrement aux utilisateurs intensifs, qui ont désormais accès à un modèle plus puissant et moins cher que celui qu'ils utilisaient jusqu'à présent.
Terminal-Bench 4.0 et CursorBench 4.0
Une grande partie de l’annonce se concentre sur deux repères de programmation qui servent de références dans l’industrie. Terminal-Bench 4.0 mesure la capacité d'un agent IA à fonctionner dans un environnement de terminal et à exécuter des commandes par lui-même, sans intervention humaine constante. Dans ce test, l'Opus 5.5 est en hausse d'environ 11 points de pourcentage par rapport à l'Opus 5, une amélioration notable pour un domaine où les progrès se mesurent souvent en fractions de point.
Dans CursorBench 4.0axé sur la qualité et la précision du code généré par le modèle au sein d'un éditeur de développement, le gain est de 6 points de pourcentage. Anthropic souligne également un score plus élevé dans les tâches de travail de connaissances, une section qui regroupe des tests de compréhension et de raisonnement sur des informations complexes, bien qu'elle n'ait pas publié le chiffre exact de cette amélioration, seulement la référence graphique partagée dans l'annonce.
L'Opus 5.5 se rapproche des performances de Fable 5.1
L'entreprise place Opus 5.5 au même niveau que Claude Fable 5.1 dans la plupart des tâches. Faire correspondre ces performances avec un modèle de la famille Opus moins cher change le calcul pour ceux qui se tournaient vers Fable 5.1 à la recherche du meilleur score possible, notamment en programmation, où il était auparavant conseillé d'opter pour Fable pour obtenir le meilleur résultat.
Anthropic n'a pas précisé dans quelles tâches spécifiques l'Opus 5.5 tombe en dessous de Fable 5.1 ou dans lesquelles il le surpasse au-delà de la programmation, où le Données Terminal-Bench et CursorBench Ils semblent en panne. Opus 5.5 est désormais disponible via l'API Anthropic pour ceux qui souhaitent l'essayer, sans que l'entreprise n'ait annoncé de modifications supplémentaires sur le reste de son catalogue pour l'instant.
FAQ Claude Opus 5.5 Il coûte 4 $ par million de jetons entrants et 20 $ par million de jetons sortants, contre 5 $ et 25 $ pour l'Opus 5.
Il augmente d'environ 11 points de pourcentage dans Terminal-Bench 4.0 et de 6 points de pourcentage dans CursorBench 4.0 par rapport à Opus 5.
Anthropic affirme qu'Opus 5.5 fonctionne à égalité avec Fable 5.1 dans la plupart des tâches et mieux en programmation.
Combien coûte Claude Opus 5.5 sur l'API ?
Quelles améliorations Claude Opus 5.5 apporte-t-il en programmation ?
Comment Claude Opus 5.5 se compare-t-il à Fable 5.1 ?