Présentation d'Opus 5

Anthropic a récemment dévoilé Opus 5, la dernière mise à jour de son modèle qui est devenu populaire pour la programmation et d'autres tâches de développement logiciel. Cette version apporte une amélioration notable, mais ne constitue pas une avancée majeure en termes de performances de codage.

Fonctionnement et performances

Les benchmarks, tels que Frontier-Bench et DeepSWE, montrent que Opus 5 offre des performances similaires ou légèrement supérieures à celles du modèle Fable d'Anthropic pour les tâches de codage. Il surpasse également Opus 4.8 et GPT-5.6-Sol d'OpenAI dans la plupart des tâches. Les améliorations se traduisent par une augmentation itérative des performances, mais pas par un bond radical.

Limites et choix d'architecture

Anthropic a choisi de ne pas fournir à Opus 5 une formation de pointe sur les tâches de cybersécurité, ce qui le place loin derrière Fable et Mythos dans ce domaine. Le modèle est relativement bon pour détecter les vulnérabilités de cybersécurité, mais en raison des décisions prises lors de sa formation, il est « nettement en retard par rapport à Mythos 5 en termes d'exploitation de ces vulnérabilités ».

Implications et limites

Opus 5 ne dispose pas des mêmes protections controversées que Fable, telles que la politique de conservation des données pour examen pendant 30 jours en cas d'incident. Le modèle offre une efficacité de token améliorée, mais à un coût inférieur, environ la moitié de celui de Fable.