Contexte de l’incident
Le 11 octobre 2026 à 01 h UTC, l’incident #2136 a été déclaré ouvert dans la zone de disponibilité ru‑central‑a de Yandex Cloud. Le niveau d’impact est indiqué comme Unavailable (niveau 2), ce qui signifie une indisponibilité totale des ressources hébergées dans cette zone. Aucun rapport détaillé n’est encore publié, mais le statut reste open au moment de la rédaction.
Architecture des zones Yandex Cloud
Yandex Cloud répartit ses services sur plusieurs zones de disponibilité (par ex. ru‑central‑a, ru‑central‑b, ru‑central‑d, ru‑central‑e) au sein d’une même région (Russia). Chaque zone possède son propre réseau d’alimentation, de refroidissement et de connectivité, afin de limiter la propagation d’une défaillance physique. La redondance inter‑zones repose sur la réplication des données (ex. Object Storage) et le basculement automatique des machines virtuelles via le service de load‑balancing.
Conséquences sur les services
Une panne d’alimentation dans ru‑central‑a entraîne l’interruption immédiate des instances, bases de données et fonctions serverless déployées dans cette zone. Les services dépendants d’une réplication multi‑zone, comme Object Storage, affichent des timings accrus (incidents #2130 résolus le 9 octobre) mais restent opérationnels grâce à la copie dans les zones ru‑central‑b et ru‑central‑d. En revanche, les workloads exclusifs à ru‑central‑a subissent une indisponibilité totale jusqu’à la restauration du courant ou le basculement manuel vers une autre zone.
Mesures et limites
Yandex Cloud recommande aux clients de concevoir leurs architectures en mode multi‑zone afin de respecter les SLA de disponibilité. La présence d’incidents similaires (panne d’alimentation #2092 dans ru‑central‑b depuis le 7 octobre) montre que la dépendance à l’alimentation locale reste un point de vulnérabilité. Sans publication de rapports techniques, il est difficile d’évaluer la rapidité de la remise en service ni les causes exactes (panne de générateur, coupure du réseau électrique, etc.). Les utilisateurs doivent surveiller les statuts via le tableau de bord Yandex Cloud et envisager des stratégies de réplication géographique au-delà de la région russe pour atténuer les risques de pannes locales.