Présentation
Claude Opus 5.5 est la version la plus récente du modèle de langage d'Anthropic. La documentation indique que le modèle génère les jetons de sortie plus de 30 % plus rapidement que Claude Opus 5 et qu’il termine les mêmes tâches avec moins de jetons. Cette amélioration de débit s’accompagne d’une architecture où la réflexion (thinking) est toujours activée, ce qui modifie la façon dont les développeurs calibrent l’effort.
Améliorations de performance et d’effort
Le paramètre effort contrôle la quantité de réflexion du modèle. Sur Claude Opus 5.5, le réglage par défaut est medium, alors que Claude Opus 5 utilisait high. Les tests internes d’Anthropic montrent que, au niveau medium, Claude Opus 5.5 égale ou dépasse les performances de Claude Opus 5 au niveau high sur les évaluations de codage, tout en consommant moins d’étapes et de jetons. En revanche, si l’on conserve le même niveau d’effort que sur Opus 5, les tours de dialogue s’allongent et le nombre de jetons augmente, car le modèle pense davantage à chaque tour.
Capacités de travail agentique et visuel
Le modèle excelle dans les tâches multistep en environnement de code réel : il peut appliquer une modification dans un dépôt, exécuter les tests et expliquer les changements en texte clair. Anthropic rapporte que, même à l’effort le plus bas, le modèle lit les valeurs de graphiques denses avec une précision supérieure à celle d’Opus 5 même à son effort maximal, tout en consommant une fraction des jetons de sortie. Cette précision s’étend aux diagrammes où la position des flèches ou des boîtes est cruciale, ainsi qu’aux captures d’écran de calendriers où le modèle identifie correctement les heures de réunion. En matière d’utilisation d’applications via captures d’écran, le taux de succès d’Opus 5.5 au réglage par défaut correspond à celui d’Opus 5 atteint uniquement avec un effort très élevé.
Consignes de migration et bonnes pratiques
La migration depuis Claude Opus 5 nécessite trois ajustements majeurs : (1) recalibrer l’effort en partant du niveau medium, (2) augmenter max_tokens pour laisser de la place aux jetons de réflexion (qui comptent dans la limite même s’ils ne sont pas renvoyés), et (3) adapter les prompts qui désactivent la réflexion, car la pensée est désormais toujours active. Les modèles de prompting spécifiques à Opus 5.5 couvrent des scénarios tels que la calibration d’effort, les mises à jour de progression visibles pour l’utilisateur, la gestion d’agents non surveillés, les refus de sauvegarde, la prise en charge de texte collé et la conception d’interfaces frontales. Les prompts existants pour Opus 5 restent fonctionnels, mais les patterns d’effort et de mise à jour de progression offrent une meilleure maîtrise du compromis entre latence, coût et profondeur de raisonnement.