Anthropic lance Claude Opus 5.5, un nouveau modèle haut de gamme annoncé comme plus performant, plus rapide et 40 % moins coûteux à exécuter qu’Opus 5 sur des charges typiques. Il est disponible dans Claude, Claude Code et l’API, avec des garde-fous renforcés pour le code, la biologie et la cybersécurité.
Le tarif public s’établit à 4 dollars par million de jetons en entrée et 20 dollars en sortie, contre 5 et 25 dollars pour Opus 5. Les lectures de cache passent de 0,50 à 0,20 dollar par million de jetons. Anthropic annonce aussi une génération plus de 30 % plus rapide.
Des gains concentrés sur les tâches longues
Anthropic positionne Opus 5.5 sur le développement logiciel agentique, l’usage d’ordinateur et le travail de connaissance. Le modèle obtient 66,4 % sur Terminal-Bench 4.0, 54,4 % sur FrontierCode v1.1 et 81,8 % sur OSWorld 2.0 avec un résultat partiel, selon les évaluations publiées par l’entreprise.
Ces scores doivent être lus avec prudence, car les réglages et les harnais diffèrent entre fournisseurs. Anthropic souligne d’ailleurs que les marges entre modèles deviennent moins représentatives de l’expérience réelle. L’entreprise insiste plutôt sur le rapport entre la qualité, le nombre de jetons utilisés et le coût par tâche.
Un testeur précoce aurait achevé une migration portant sur 680 000 lignes de code en moins d’une journée. Dans un essai interne, Opus 5.5 a audité et corrigé 200 000 lignes en moins de trois heures, contre plus de 20 heures pour Opus 5. Ces exemples restent fournis par Anthropic et ses partenaires, mais illustrent le type de travail visé.
Un contrôle avant chaque action
La sécurité constitue l’autre axe du lancement. Anthropic affirme qu’Opus 5.5 obtient son meilleur résultat à ce jour sur son audit comportemental automatisé. Le modèle serait moins susceptible d’entreprendre des actions difficiles à annuler ou de sortir du périmètre demandé, et plus résistant aux injections de prompt qu’Opus 5.
Pour les agents de programmation, un classificateur examine chaque action avant son exécution. Anthropic met également en avant un bac à sable open source auditable et une fonction de revue de code destinée à repérer des vulnérabilités avant leur fusion.
Les capacités en biologie et cybersécurité conduisent toutefois à restreindre certains usages. Les organisations validées peuvent demander l’accès au programme de vérification pour les sciences de la vie. Un élargissement du programme cyber est prévu dans les prochaines semaines pour les praticiens vérifiés.
Une nouvelle famille Claude 5.5
Opus 5.5 inaugure la famille Claude 5.5. Anthropic prévoit de lancer Sonnet 5.5 et Haiku 5.5 dans les semaines à venir, avec une partie des mêmes améliorations de performance, d’efficacité et de sécurité. Le modèle actuel se situe, selon la société, au niveau de Claude Fable 5.1 sur la plupart des travaux malgré un coût inférieur.
Notre analyse
La baisse de prix compte autant que les scores. Pour un agent qui travaille plusieurs heures sur un dépôt ou un ensemble de documents, les lectures de cache et le nombre total d’étapes peuvent peser davantage que le tarif facial de sortie. Anthropic cherche clairement à rendre son modèle le plus puissant utilisable sur des flux réguliers, pas seulement sur des requêtes exceptionnelles.
