Présentation d'Opus 5

Anthropic a lancé son modèle Opus 5, la dernière version de son modèle lourd établi. Bien que plus petit que Fable 5, le modèle sera à la fois moins cher et moins restrictif que Fable, le rendant probablement préférable dans la plupart des cas d'utilisation.

Notamment, Opus 5 surpasse Fable 5 sur plusieurs benchmarks inclus dans l'annonce. Opus 5 est lancé seulement deux mois après Opus 4.8, qui est devenu disponible le 28 mai.

Fonctionnement d'Opus 5

Anthropic a souligné que Opus 5 est « beaucoup plus fort pour vérifier son travail et itérer soigneusement jusqu'à ce qu'il réussisse », en citant les tests de benchmark, dans lesquels Opus 5 a écrit sa propre pipeline de vision par ordinateur en réponse à une invite incomplète, entre autres exemples.

Opus 5 est également exempt de nombreuses restrictions qui ont freiné Fable depuis sa sortie. Comme son prédécesseur, Opus 5 n'est pas soumis à la politique de rétention des données de 30 jours qui couvre Fable et Mythos, ce qui avait suscité des inquiétudes parmi certains utilisateurs conscients de la vie privée.

Implications et limites

Il existe encore des garanties significatives sur Opus, en particulier autour des tâches de cybersécurité comme la génération d'exploits et les tests de pénétration. Par exemple, les garanties d'Opus 5 empêchent qu'il ne soit utilisé pour analyser les vulnérabilités dans un logiciel binaire, bien qu'il soit autorisé à rechercher des vulnérabilités dans le code source, puisque cette dernière tâche est plus susceptible d'être utilisée à des fins défensives.

Anthropic s'attend à ce que ces classificateurs soient sollicités 85 % moins souvent pour Opus 5 que pour Fable 5, ce qui reflète l'approche plus légère donnée au modèle moins capable. Anthropic déploie également un nouvel outil pour rendre les garanties moins disruptives lorsqu'elles sont sollicitées.

Évolution de l'API

Les utilisateurs peuvent maintenant opter pour une fonctionnalité bêta appelée Automatic Fallbacks, qui routera automatiquement les requêtes vers un modèle moins puissant lorsque une invite déclenche le classificateur de sécurité. Le résultat est que les utilisateurs de l'API avec le paramètre activé obtiendront une réponse fonctionnelle au lieu d'un message d'erreur.

Exemple de code pour la fonctionnalité Automatic Fallbacks

Anthropic continue d'améliorer ses modèles et ses outils pour offrir une expérience utilisateur plus fluide et plus sécurisée.