Anthropic a lancé Opus 5.5 avec des prix de jetons plus bas, une sortie plus rapide et des résultats annoncés au niveau de Fable, rehaussant la barre pour une IA d’entreprise efficace.

Anthropic a publié Claude Opus 5.5, un nouveau modèle phare que l’entreprise dit égaler ou dépasser son système plus capable Fable 5.1 sur de nombreuses tâches tout en coûtant moins cher à exploiter. Ce lancement donne aux développeurs accès à un modèle haut de gamme plus rapide et moins cher, à un moment où les acheteurs d’IA comparent les capacités aux coûts d’inférence.
Opus 5.5 est disponible immédiatement via les services d’Anthropic et les principales plateformes cloud. L’entreprise affirme également avoir amélioré le style d’écriture du modèle, en réduisant le jargon et en plaçant les informations importantes plus tôt dans les réponses. Ces changements ciblent une plainte récurrente concernant la sortie trop stéréotypée ou excessivement élaborée des modèles Claude précédents.
Anthropic affiche Opus 5.5 à 4 dollars par million de jetons d’entrée et 20 dollars par million de jetons de sortie, contre 5 et 25 dollars pour Opus 5. L’entreprise affirme aussi que les coûts de lecture du cache ont chuté de 60 pour cent. TechCrunch a rapporté le prix de sortie comme une baisse de 25 à 20 dollars par million de jetons et a noté que le nouveau modèle nécessite moins de calcul pour être servi.
Anthropic estime que les coûts d’exploitation totaux devraient être d’environ 40 pour cent inférieurs à ceux d’Opus 5 lorsque l’utilisation des jetons est incluse. Cette estimation plus large reflète la capacité revendiquée du modèle à utiliser moins de jetons, ainsi qu’une sortie générée plus de 30 pour cent plus rapidement. La distinction est importante pour les équipes de production : des prix affichés plus bas ne garantissent pas automatiquement des factures plus basses si un modèle utilise nettement plus de jetons sur des tâches difficiles.
Les limites d’utilisation sur cinq heures pour les abonnés augmenteront de 20 pour cent, selon le compte rendu de The Decoder sur l’annonce d’Anthropic. Anthropic affirme que la combinaison de limites plus élevées et de coûts d’utilisation plus faibles devrait accroître la capacité pratique d’environ 25 pour cent.
Le modèle est disponible sur la Claude Platform avec l’identifiant de modèle claude-opus-5-5, ainsi que via Amazon Web Services, Google Cloud et Microsoft Azure. Cette distribution donne aux équipes d’entreprise davantage d’options pour intégrer le modèle dans les systèmes cloud, de conformité et d’approvisionnement existants.
Anthropic décrit Opus 5.5 comme son modèle le plus performant à ce jour et affirme qu’il atteint le niveau de Claude Fable 5.1 sur la plupart des tâches. Ses comparaisons placent également le nouveau modèle devant GPT-6 Astra d’OpenAI sur plusieurs évaluations, malgré un prix affiché plus bas. Il s’agit d’affirmations rapportées par le fournisseur et elles ne doivent pas être considérées comme une confirmation indépendante d’une supériorité générale.
The Decoder a détaillé davantage les comparaisons de codage d’Anthropic. Sur FrontierCode, l’entreprise affirme qu’Opus 5.5 surpasse GPT-6 Astra pour environ 20 pour cent du coût par tâche. Sur Terminal-Bench 4.0, Anthropic revendique des performances comparables à 40 pour cent du coût d’Astra, tandis que sur CursorBench elle annonce un avantage de 11 points sur GPT-5.6 Sol pour un tiers du coût.
Il existe un certain soutien externe à la position du modèle dans les benchmarks. Artificial Analysis, une plateforme indépendante citée par The Decoder, a attribué à Opus 5.5 un score de 58 sur son Intelligence Index à effort maximal, le score le plus élevé enregistré sur cet index au moment du rapport. Elle a aussi signalé des résultats de tête sur six des dix évaluations, dont Humanity’s Last Exam et SciCode.
Cependant, la même analyse a mis en évidence un compromis d’efficacité. À effort maximal, Opus 5.5 aurait généré environ 119 000 jetons de sortie par tâche, contre 73 000 pour Opus 5, 78 000 pour Fable 5.1 et 27 000 pour GPT-6 Astra. Des prix plus bas par jeton peuvent compenser cette utilisation dans certaines charges de travail, mais le modèle n’est pas nécessairement moins cher sur chaque tâche individuelle.
Anthropic affirme qu’Opus 5.5 est moins susceptible d’utiliser du jargon, plus susceptible de commencer par les informations les plus importantes et meilleur pour suivre les consignes d’écriture. Des premiers testeurs décrits par The Decoder ont trouvé la sortie plus claire, mais ces impressions restent limitées et ne remplacent pas une évaluation contrôlée sur de vrais flux de travail.
La sortie étend également les contrôles de sécurité appliqués aux modèles les plus capables d’Anthropic. Opus 5.5 bénéficie de garde-fous comparables à Fable 5.1 pour la cybersécurité, la biologie et le développement d’IA de pointe. Anthropic affirme que les requêtes déclenchant ces contrôles peuvent être redirigées vers un autre modèle. La plupart des travaux de cybersécurité signalés seraient orientés vers Opus 4.8, tandis que certaines requêtes liées à la biologie et au développement de pointe vont à Opus 5.
Les organisations vérifiées peuvent demander un accès à la recherche biologique via le Life Sciences Verification Program d’Anthropic. L’entreprise prévoit d’étendre son Cyber Verification Program à Opus 5.5. Le modèle inclut aussi « Preserved Thinking », qui empêche les utilisateurs de l’API de modifier le contexte précédent afin d’extraire le raisonnement, ainsi que des mesures de filigrane décrites comme soutenant la conformité à l’EU AI Act.
Anthropic indique qu’Opus 5.5 a fait l’objet d’une évaluation avant sa sortie par METR et Frontier Design. L’entreprise prépare également un filtrage plus strict des environnements de reinforcement learning, une surveillance renforcée et des scénarios automatisés de formation à la sécurité. Ces plans sont importants, mais ils décrivent un travail en cours plutôt qu’une preuve que tous les risques d’alignement ou d’usage abusif ont été résolus.
Pour les équipes logicielles, la principale opportunité n’est pas seulement l’accès à un meilleur score de benchmark. Un modèle qui combine de solides performances en codage et en travail intellectuel avec des prix publiés plus bas pourrait rendre les agents IA de longue durée plus pratiques, en particulier pour la revue de code, le débogage, la documentation, la recherche et l’analyse interne.
Le coût dépendra fortement des réglages d’effort, de la conception des prompts, de la réutilisation du contexte et de la longueur des sorties. Les chiffres d’Artificial Analysis suggèrent qu’Opus 5.5 à effort maximal peut consommer beaucoup plus de jetons que les systèmes concurrents. Les équipes devraient donc tester le coût par flux de travail terminé plutôt que de comparer uniquement les prix des jetons.
Pour les acheteurs d’entreprise, la disponibilité sur Claude Platform, Amazon Web Services, Google Cloud et Microsoft Azure peut réduire les frictions de déploiement. Mais les acheteurs devront toujours valider la latence, les options de conservation des données, le comportement de routage lorsque les garde-fous s’activent, et la fiabilité du modèle sur leurs propres documents et outils. Les affirmations d’Anthropic sur une écriture plus claire pourraient compter dans les longues sessions, mais doivent être mesurées par rapport aux modèles existants plutôt que supposées.
La sortie d’Anthropic intensifie aussi la concurrence entre modèles premium. L’entreprise positionne Opus 5.5 face à Fable 5.1 et GPT-6 Astra tout en répondant à des alternatives moins chères, y compris des modèles chinois que The Decoder a décrits comme offrant de moindres performances à des prix bien plus bas. La prochaine phase de la concurrence pourrait se jouer autant sur le coût par tâche réussie et les contrôles de déploiement que sur la domination mise en avant dans les benchmarks.
Le signal immédiat sera de voir si des évaluations indépendantes reproduisent les gains annoncés par Anthropic en codage, en travail agentique et en tâches métier. Les coûts réels pour les clients seront un autre test important, en particulier pour les charges de travail à effort maximal qui produisent de grandes sorties.
Anthropic affirme que Sonnet 5.5 et Haiku 5.5 arriveront dans les prochaines semaines avec des améliorations similaires en performance, efficacité et sécurité. Leur tarification et leurs capacités montreront si les changements d’Opus constituent une refonte plus large de la famille ou surtout une mise à niveau phare.
Les développeurs devraient aussi suivre le déploiement du Cyber Verification Program, les changements de routage du modèle sous contrôle de sécurité et davantage de détails sur les mesures de surveillance et d’anti-distillation d’Anthropic. Ces politiques pourraient affecter les flux de travail de recherche et de sécurité pouvant s’exécuter directement sur Opus 5.5.
Opus 5.5 est important parce qu’Anthropic vend l’efficacité comme faisant partie de la capacité, et non comme un compromis avec elle. Les résultats rapportés par l’entreprise suggèrent que les produits d’IA premium évoluent vers un indicateur plus pratique : le coût et la fiabilité de l’exécution d’un flux de travail complet.
Les preuves sont prometteuses, mais elles restent fortement façonnées par les propres benchmarks et choix de test d’Anthropic. Pour les développeurs et les acheteurs, la réponse sensée est une évaluation ciblée : mesurer l’achèvement réussi des tâches, la consommation de jetons, la latence, le routage de sécurité et les besoins de retouche humaine sur des travaux représentatifs avant de considérer la réduction revendiquée de 40 pour cent des coûts d’exploitation comme un fait de production.