Gestione degli incidenti e continuità operativa
ISMS Copilot ha stabilito procedure di gestione degli incidenti e continuità operativa per garantire il rilevamento, il contenimento e il ripristino rapidi da incidenti di sicurezza o interruzioni del servizio…
ISMS Copilot ha stabilito procedure di gestione degli incidenti e continuità operativa per garantire il rilevamento, il contenimento e il ripristino rapidi da incidenti di sicurezza o interruzioni del servizio. Il nostro approccio dà priorità alla protezione dei dati dei clienti e alla disponibilità del servizio.
La risposta agli incidenti è integrata con il nostro processo di gestione delle modifiche e le procedure di escalation per garantire una risposta coordinata.
Processo di risposta agli incidenti
La nostra gestione degli incidenti segue un approccio in cinque fasi:
- Rilevamento — I sistemi di monitoraggio, le segnalazioni dei clienti o le scansioni di sicurezza identificano potenziali incidenti
- Valutazione — Viene valutata la gravità e l'ambito dell'incidente per determinare il livello di risposta
- Contenimento — Vengono intraprese azioni immediate per limitare l'impatto e prevenire la diffusione
- Ripristino — I sistemi vengono riportati al normale funzionamento con le correzioni implementate
- Revisione post-incidente — Viene condotta un'analisi delle cause radice e implementate misure preventive
Ruoli e responsabilità
Il nostro team di risposta agli incidenti include ruoli definiti:
- Comandante dell'Incidente — Il CEO guida il coordinamento complessivo della risposta e la comunicazione con gli stakeholder
- Primario e Secondario di reperibilità — Risponditori tecnici disponibili per una valutazione e risoluzione rapida
- Responsabile della Comunicazione — Gestisce le notifiche ai clienti e gli aggiornamenti sullo stato
Per gli incidenti di sicurezza che coinvolgono i dati dei clienti o implicazioni di conformità, eseguiamo immediatamente l'escalation alla direzione.
Procedure di escalation
Gli incidenti vengono escalati in base alla gravità e all'impatto:
- Coordinamento del team tramite il canale Slack dedicato #incidents
- Notifica alla direzione via email per incidenti di elevata gravità
- Comunicazione ai clienti per incidenti che influiscono sul servizio
- Notifica normativa se richiesta dal GDPR o altri framework di conformità
Pianificazione della continuità operativa
Oltre alla risposta agli incidenti, manteniamo procedure di continuità operativa che includono:
- Capacità di backup e disaster recovery
- Monitoraggio delle dipendenze da terze parti e pianificazione delle contingenze
- Ridondanza dell'infrastruttura per i servizi critici
- Procedure di conservazione e recupero dei dati
- Meccanismi di failover e resilienza dei provider AI
Failover e resilienza dei provider AI
Per garantire la continuità dei servizi di conformità basati su AI durante le interruzioni dei provider, ISMS Copilot implementa meccanismi di failover automatico:
Percorso predefinito del provider (Anthropic/OpenAI):
- Monitoraggio Circuit Breaker: Il monitoraggio in tempo reale dello stato del provider AI primario (Anthropic Claude) traccia errori 5xx, limiti di frequenza 529 e guasti di rete in una finestra scorrevole
- Failover automatico: Quando gli errori superano la soglia, le richieste vengono automaticamente indirizzate al provider di backup (OpenAI) senza intervento dell'utente
- Ripristino automatico: Il sistema verifica periodicamente il provider primario per rilevare il ripristino e tornare allo stato operativo quando è sano
- Notifica agli utenti: Un banner persistente avvisa gli utenti durante gli eventi di failover mentre il servizio continua senza interruzioni
- Bypass della selezione del provider: Gli utenti che selezionano esplicitamente modelli specifici (ad es., Gemini, Grok, Mistral) bypassano il failover automatico—la loro selezione viene rispettata
Il failover automatico garantisce un'elevata disponibilità per la maggior parte degli utenti sui percorsi predefiniti dei provider, riducendo al minimo le interruzioni durante gli incidenti dei provider AI.
Modalità di protezione avanzata dei dati (solo UE tramite Mistral):
- Nessun failover disponibile: Gli utenti con la Protezione Avanzata dei Dati abilitata (elaborazione solo UE) utilizzano esclusivamente Mistral AI
- Limitazione a un singolo provider: Mistral è attualmente il nostro unico provider con sede nell'UE con accordi di zero retention, quindi non esiste un backup UE
- Impatto sul servizio: Le interruzioni di Mistral possono causare interruzioni del servizio per gli utenti solo UE fino al ripristino del provider
- Ragione del compromesso: La modalità solo UE dà priorità alla sovranità dei dati e alla zero retention rispetto alla resilienza del failover
- Miglioramento futuro: Stiamo lavorando attivamente per aggiungere un secondo provider UE per abilitare il failover per gli utenti con Protezione Avanzata dei Dati
Le organizzazioni che scelgono la Modalità di Protezione Avanzata dei Dati accettano questo compromesso sulla disponibilità in cambio di una rigorosa residenza dei dati nell'UE e di zero retention da parte del provider AI. Per requisiti critici di uptime, valutate se la modalità predefinita (con failover automatico ma elaborazione negli USA) è accettabile per la vostra postura di conformità.
Monitoraggio e trasparenza:
- Le metriche di salute dei provider sono monitorate continuamente tramite strumentazione circuit breaker
- Gli eventi di failover vengono registrati e rivisti nell'analisi post-incidente
- Le comunicazioni sulla pagina di stato informano gli utenti sugli incidenti in corso dei provider
- Lo stato del circuit breaker è esposto tramite endpoint di monitoraggio interno per la visibilità operativa
Gli incidenti post-distribuzione attivano le nostre procedure di rollback della gestione delle modifiche, mantenendo la documentazione degli incidenti per la revisione.
Documentazione e apprendimento
Ogni incidente genera documentazione che include timeline, valutazione dell'impatto, causa radice e azioni preventive. Questi insegnamenti confluiscono nel nostro registro dei rischi e nella pianificazione della prevenzione delle minacce.
Le nostre procedure di gestione degli incidenti sono allineate con il nostro framework ISMS complessivo e supportano i requisiti di conformità SOC 2, ISO 27001 e NIST.