Contexte de l'incident
Le 29 septembre 2026, à 14 h 00 UTC, les services de Claude (claude.ai, Claude Code, Claude Cowork et l'API) ont enregistré une hausse soudaine des taux d’erreur. Les premières notifications indiquaient des réponses d’erreur pour les requêtes web, les sessions de code et les appels API. Une mise à jour à 14 h 21 UTC a confirmé que les utilisateurs rencontraient des échecs de connexion, des interruptions de conversations et l’impossibilité de lancer de nouveaux chats ou d’effectuer des achats.
Architecture affectée
Claude repose sur une architecture multi‑couche : une couche frontale (applications web, desktop et mobile) qui interroge le service d’authentification (SSO, Sign‑in with Apple), une couche métier exposée via l’API (api.anthropic.com) et des micro‑services dédiés à la génération de texte, à la voix et à la gestion de fichiers. Chaque couche dépend d’un bus de messages interne et d’une base de données de sessions. L’incident a touché simultanément le point d’entrée (gateway) et les services d’authentification, ce qui explique la cascade d’erreurs signalées.
Analyse des causes probables
Les rapports indiquent que les erreurs ont été « mitigées » à 14 h 36 UTC, suggérant une intervention sur un composant saturé ou défaillant. Une hausse du taux d’erreur sans chiffre précis pointe souvent vers un goulet d’étranglement du serveur d’authentification ou un dépassement de capacité du pool de connexions à la base de données. Le fait que les tentatives de connexion, les actions de compte et les sessions Claude Code restent partiellement défaillantes après la mitigation renforce l’hypothèse d’un problème persistant dans le service d’état (state‑service) qui stocke les jetons d’accès.
Conséquences et mesures d’atténuation
Pour les utilisateurs finaux, la perte d’accès a entraîné l’interruption de conversations, l’impossibilité de créer de nouveaux chats, de lancer des sessions de code ou d’utiliser la fonction voix. Les développeurs intégrant l’API ont observé des réponses d’erreur HTTP, ce qui a pu impacter les pipelines automatisés. Anthropic a recommandé de ne pas se déconnecter pendant l’incident afin d’éviter la perte de session. Après la mitigation, les taux d’erreur ont « diminué substantiellement », mais des échecs isolés subsistent, indiquant que la restauration complète du service nécessite un redéploiement du composant d’authentification et des tests de charge supplémentaires.