Comment préparer la perte d'un datacenter ou l'indisponibilité d'une région cloud ?
D’après Gestion des incidents
Indisponibilité datacenter : bascule, énergie, chaîne froide
Une panne d’infrastructure majeure exige des réflexes physiques : énergie, climatisation, accès, sécurité.
La stratégie technique déclenche le PRA : bascule vers le site de secours, activation des réseaux alternatifs, montée des socles.
La CCE décide des priorités de reprise, des arbitrages logistiques (équipes, transport, hébergement), et des messages clients.
On est bien d’accord que cela aurait dû être fait en amont bien sûr.
On anticipe les effets de bord : licences, quotas, latences, dépendances aux opérateurs.
La coordination avec les fournisseurs est critique : opérateurs, hébergeur, support matériel.
La réussite tient à la préparation : runbooks testés, inventaires à jour, kits d’accès, procédures d’entrée sur site.
La froideur d’exécution l’emporte sur la créativité de dernière minute.
Indisponibilité cloud : quotas, régions, contrats
Le cloud promet l’élasticité, il impose la réalité des quotas et des limites de service.
En incident régional, on bascule vers une autre région si l’architecture et les données l’autorisent.
On arbitre entre réplication (coût, délai) et dégradation (réduction de périmètre).
Les contrats pèsent : SLA, crédits, accès aux journaux, priorisation de support.
La CCE statue sur la tolérance à une expérience réduite, informe les clients de manière transparente, protège les équipes de la tentation de bricoler hors cadre.
Après coup, on réévalue l’architecture : zones multiples, panels de contrôles indépendant, tests réguliers de bascule, limites explicites des plateformes managées.
