Incident & gouvernance
Une plateforme interne devient indisponible. Un compte administrateur présente une connexion inhabituelle. Vous participez à la cellule de décision.
Les premières minutes
Vous ne savez pas encore si la panne et la connexion sont liées. Quelle première décision proposez-vous ?
Mobiliser les responsables, contenir le compte suspect et préserver les traces utiles.
La coordination permet de décider du périmètre de confinement avec l’exploitation. Préserver les traces aide à vérifier les hypothèses. Une reconstruction générale trop tôt peut effacer des éléments utiles.
Preuve utile : Horodatage, compte concerné, systèmes touchés et décision de confinement.
La pression pour redémarrer
Une sauvegarde est disponible. Le métier demande une reprise immédiate. Que faut-il établir ?
Que la sauvegarde est exploitable et que la restauration peut être vérifiée dans un environnement maîtrisé.
L’existence d’une sauvegarde ne prouve ni son intégrité ni la capacité de reprise. Il faut définir les contrôles techniques et métiers, puis valider le résultat de la restauration.
Preuve utile : Rapport de restauration, contrôles d’intégrité et validation métier.
Accepter le risque restant
Le service peut reprendre avec une mesure temporaire. Une faiblesse reste ouverte. Comment organiser la décision ?
Faire valider le risque par le responsable habilité, avec une action, un propriétaire et une date de réexamen.
L’arbitrage doit appartenir au responsable du risque. La mesure temporaire devient suivable si sa portée, son propriétaire et sa date de réexamen sont explicites.
Preuve utile : Décision datée, risque résiduel, responsable et échéance.
