ISMS Copilot Docs

Gestion des incidents et continuité d'activité

ISMS Copilot a établi des procédures de gestion des incidents et de continuité d'activité pour assurer une détection, une contention et une récupération rapides en cas d'incidents de sécurité ou de perturbations de service…

ISMS Copilot a mis en place des procédures de gestion des incidents et de continuité d'activité pour garantir une détection, une contention et une récupération rapides en cas d'incidents de sécurité ou de perturbations de service. Notre approche privilégie la protection des données clients et la disponibilité des services.

La réponse aux incidents est intégrée à notre processus de gestion des changements et à nos procédures d'escalade pour assurer une réponse coordonnée.

Processus de réponse aux incidents

Notre gestion des incidents suit une approche en cinq phases :

  1. Détection — Les systèmes de surveillance, les signalements des clients ou les analyses de sécurité identifient les incidents potentiels
  2. Évaluation — La gravité et l'étendue de l'incident sont évaluées pour déterminer le niveau de réponse
  3. Contention — Des actions immédiates sont prises pour limiter l'impact et empêcher la propagation
  4. Récupération — Les systèmes sont rétablis en fonctionnement normal avec le déploiement des correctifs
  5. Revue post-incident — Une analyse des causes profondes est menée et des mesures préventives sont mises en œuvre

Rôles et responsabilités

Notre équipe de réponse aux incidents comprend des rôles définis :

  • Commandant de l'incident — Le PDG dirige la coordination globale de la réponse et la communication avec les parties prenantes
  • Astreinte principale et secondaire — Répondants techniques disponibles pour une évaluation et une remédiation rapides
  • Responsable de la communication — Gère les notifications aux clients et les mises à jour de statut

Pour les incidents de sécurité impliquant des données clients ou ayant des implications en matière de conformité, nous escaladons immédiatement vers la direction.

Procédures d'escalade

Les incidents sont escaladés en fonction de leur gravité et de leur impact :

  • Coordination de l'équipe via le canal Slack dédié #incidents
  • Notification de la direction par e-mail pour les incidents de haute gravité
  • Communication avec les clients pour les incidents affectant le service
  • Notification réglementaire si requise par le RGPD ou d'autres cadres de conformité

Plan de continuité d'activité

Au-delà de la réponse aux incidents, nous maintenons des procédures de continuité d'activité incluant :

  • Capacités de sauvegarde et de reprise après sinistre
  • Surveillance des dépendances tierces et planification des mesures d'urgence
  • Redondance de l'infrastructure pour les services critiques
  • Procédures de rétention et de récupération des données
  • Mécanismes de basculement et de résilience des fournisseurs d'IA

Basculement et résilience des fournisseurs d'IA

Pour garantir la continuité des services de conformité basés sur l'IA lors de pannes de fournisseurs, ISMS Copilot met en œuvre des mécanismes de basculement automatique :

Chemin du fournisseur par défaut (Anthropic/OpenAI) :

  • Surveillance par disjoncteur : Suivi en temps réel de l'état de santé du fournisseur d'IA principal (Anthropic Claude) surveillant les erreurs 5xx, les limites de taux 529 et les défaillances réseau dans une fenêtre glissante
  • Basculement automatique : Lorsque les erreurs dépassent le seuil, les requêtes sont automatiquement redirigées vers le fournisseur de secours (OpenAI) sans intervention de l'utilisateur
  • Récupération automatique : Le système sonde périodiquement le fournisseur principal pour détecter la reprise et rebascule lorsque celui-ci est à nouveau sain
  • Notification aux utilisateurs : Une bannière persistante alerte les utilisateurs lors des événements de basculement tandis que le service continue sans interruption
  • Contournement de la sélection du fournisseur : Les utilisateurs qui sélectionnent explicitement des modèles spécifiques (par exemple, Gemini, Grok, Mistral) contournent le basculement automatique—leur sélection est respectée

Le basculement automatique offre une haute disponibilité pour la majorité des utilisateurs sur les chemins de fournisseurs par défaut, minimisant les perturbations lors d'incidents chez les fournisseurs d'IA.

Mode de protection avancée des données (UE uniquement via Mistral) :

  • Aucun basculement disponible : Les utilisateurs avec la protection avancée des données activée (traitement UE uniquement) utilisent exclusivement Mistral AI
  • Limitation à un seul fournisseur : Mistral est actuellement notre seul fournisseur basé dans l'UE avec des accords de non-conservation, donc aucune sauvegarde UE n'existe
  • Impact sur le service : Les pannes de Mistral peuvent entraîner une interruption de service pour les utilisateurs UE uniquement jusqu'à la reprise du fournisseur
  • Raison du compromis : Le mode UE uniquement privilégie la souveraineté des données et la non-conservation par rapport à la résilience du basculement
  • Amélioration future : Nous travaillons activement à l'ajout d'un second fournisseur UE pour permettre le basculement pour les utilisateurs en mode de protection avancée des données

Les organisations choisissant le mode de protection avancée des données acceptent ce compromis de disponibilité en échange d'une résidence stricte des données dans l'UE et d'une non-conservation par le fournisseur d'IA. Pour les exigences critiques de temps de disponibilité, évaluez si le mode par défaut (avec basculement automatique mais traitement aux États-Unis) est acceptable pour votre posture de conformité.

Surveillance et transparence :

  • Les métriques de santé des fournisseurs sont surveillées en continu via l'instrumentation du disjoncteur
  • Les événements de basculement sont enregistrés et examinés lors de l'analyse post-incident
  • Les communications sur la page de statut informent les utilisateurs des incidents en cours chez les fournisseurs
  • L'état du disjoncteur est exposé via un point de terminaison de surveillance interne pour une visibilité opérationnelle

Les incidents post-déploiement déclenchent nos procédures de retour arrière de la gestion des changements tout en maintenant la documentation des incidents pour examen.

Documentation et apprentissage

Chaque incident génère une documentation incluant la chronologie, l'évaluation de l'impact, la cause racine et les actions préventives. Ces enseignements alimentent notre registre des risques et notre planification de prévention des menaces.

Nos procédures de gestion des incidents s'alignent sur notre cadre global de SMSI et soutiennent les exigences de conformité SOC 2, ISO 27001 et NIST.

On this page