Comment mesurer le délai de reprise réellement obtenu pendant un test ?
D’après Plan de reprise d’activité
Rappels sur RTO et RPO
RTO (Recovery Time Objective) : le délai maximal d’interruption acceptable pour un service/une application.
Par exemple, un RTO de 4 heures signifie qu’on veut être capable de remettre le service en route avant 4 heures de panne.
RPO (Recovery Point Objective) : la quantité (ou période) de données maximales que l’on peut se permettre de perdre.
Par exemple, un RPO de 1 heure signifie qu’on accepte de perdre jusqu’à 1 heure de transactions ou de modifications de données.
Mesure du RTO effectif
Lors du test :
Chronométrer précisément le temps qui s’écoule entre le déclenchement (ou la détection) de l’incident simulé et la remise en service effective.
Vérifier si le début du chronomètre coïncide bien avec le moment où la panne est officiellement reconnue (déclaration de sinistre) ou si des retards supplémentaires sont survenus (temps de détection trop long, etc.).
Comparer ce temps total avec le RTO ciblé :
Si le RTO effectif est plus court que le RTO visé, c’est un succès (avec parfois une marge de progression possible).
Si le RTO effectif est plus long, il y a non-conformité : identifier les causes de dépassement (scripts trop longs, manque de coordination, ressources indisponibles, etc.).
