ISMS Copilot Docs

Gestión de Incidentes y Continuidad del Negocio

ISMS Copilot ha establecido procedimientos de gestión de incidentes y continuidad del negocio para garantizar la detección, contención y recuperación rápidas de incidentes de seguridad o interrupciones del servicio…

ISMS Copilot ha establecido procedimientos de gestión de incidentes y continuidad del negocio para garantizar la detección, contención y recuperación rápidas de incidentes de seguridad o interrupciones del servicio. Nuestro enfoque prioriza la protección de los datos del cliente y la disponibilidad del servicio.

La respuesta a incidentes está integrada con nuestro proceso de gestión de cambios y procedimientos de escalado para garantizar una respuesta coordinada.

Proceso de Respuesta a Incidentes

Nuestra gestión de incidentes sigue un enfoque de cinco fases:

  1. Detección — Los sistemas de monitoreo, informes de clientes o escaneos de seguridad identifican incidentes potenciales
  2. Evaluación — Se evalúa la gravedad y el alcance del incidente para determinar el nivel de respuesta
  3. Contención — Se toman medidas inmediatas para limitar el impacto y evitar su propagación
  4. Recuperación — Los sistemas se restauran a su funcionamiento normal con las correcciones implementadas
  5. Revisión Post-Incidente — Se realiza un análisis de la causa raíz y se implementan medidas preventivas

Roles y Responsabilidades

Nuestro equipo de respuesta a incidentes incluye roles definidos:

  • Comandante del Incidente — El CEO lidera la coordinación general de la respuesta y la comunicación con los interesados
  • Primario y Secundario de Guardia — Respondedores técnicos disponibles para una evaluación y remediación rápidas
  • Responsable de Comunicación — Gestiona las notificaciones a los clientes y las actualizaciones de estado

Para incidentes de seguridad que involucren datos de clientes o implicaciones de cumplimiento, escalamos a la dirección de inmediato.

Procedimientos de Escalado

Los incidentes se escalan según su gravedad e impacto:

  • Coordinación del equipo a través del canal dedicado de Slack #incidents
  • Notificación a la dirección por correo electrónico para incidentes de alta gravedad
  • Comunicación con el cliente para incidentes que afecten al servicio
  • Notificación regulatoria si es requerida por el GDPR u otros marcos de cumplimiento

Planificación de Continuidad del Negocio

Más allá de la respuesta a incidentes, mantenemos procedimientos de continuidad del negocio que incluyen:

  • Capacidades de copia de seguridad y recuperación ante desastres
  • Monitoreo de dependencias de terceros y planificación de contingencias
  • Redundancia de infraestructura para servicios críticos
  • Procedimientos de retención y recuperación de datos
  • Mecanismos de conmutación por error y resiliencia para proveedores de IA

Conmutación por Error y Resiliencia de Proveedores de IA

Para garantizar la continuidad de los servicios de cumplimiento impulsados por IA durante cortes de proveedores, ISMS Copilot implementa mecanismos de conmutación por error automáticos:

Ruta del Proveedor Predeterminado (Anthropic/OpenAI):

  • Monitoreo del Cortacircuitos: El seguimiento en tiempo real del proveedor de IA principal (Anthropic Claude) supervisa errores 5xx, límites de tasa 529 y fallos de red en una ventana deslizante
  • Conmutación por Error Automática: Cuando los errores superan el umbral, las solicitudes se redirigen automáticamente al proveedor de respaldo (OpenAI) sin intervención del usuario
  • Recuperación Automática: El sistema sondea periódicamente al proveedor principal para detectar su recuperación y volver a cambiar cuando esté saludable
  • Notificación al Usuario: Un banner persistente alerta a los usuarios durante eventos de conmutación por error mientras el servicio continúa sin interrupciones
  • Omisión de Selección de Proveedor: Los usuarios que seleccionan explícitamente modelos específicos (por ejemplo, Gemini, Grok, Mistral) omiten la conmutación por error automática: se respeta su selección

La conmutación por error automática proporciona alta disponibilidad para la mayoría de los usuarios en rutas de proveedor predeterminadas, minimizando las interrupciones durante incidentes con proveedores de IA.

Modo de Protección Avanzada de Datos (solo UE a través de Mistral):

  • Sin Conmutación por Error Disponible: Los usuarios con Protección Avanzada de Datos habilitada (procesamiento solo en la UE) utilizan exclusivamente Mistral AI
  • Limitación de Proveedor Único: Mistral es actualmente nuestro único proveedor con sede en la UE con acuerdos de cero retención, por lo que no existe un respaldo en la UE
  • Impacto en el Servicio: Los cortes de Mistral pueden causar interrupciones del servicio para los usuarios solo de la UE hasta que el proveedor se recupere
  • Razón del Compromiso: El modo solo UE prioriza la soberanía de los datos y la cero retención sobre la resiliencia de la conmutación por error
  • Mejora Futura: Estamos trabajando activamente para añadir un segundo proveedor en la UE y habilitar la conmutación por error para los usuarios de Protección Avanzada de Datos

Las organizaciones que eligen el Modo de Protección Avanzada de Datos aceptan este compromiso de disponibilidad a cambio de una residencia estricta de datos en la UE y cero retención por parte del proveedor de IA. Para requisitos críticos de tiempo de actividad, evalúe si el modo predeterminado (con conmutación por error automática pero procesamiento en EE. UU.) es aceptable para su postura de cumplimiento.

Monitoreo y Transparencia:

  • Las métricas de salud del proveedor se monitorean continuamente mediante instrumentación de cortacircuitos
  • Los eventos de conmutación por error se registran y revisan en el análisis post-incidente
  • Las comunicaciones en la página de estado informan a los usuarios sobre incidentes en curso con los proveedores
  • El estado del cortacircuitos se expone a través de un endpoint de monitoreo interno para visibilidad operativa

Los incidentes posteriores al despliegue activan nuestros procedimientos de reversión de gestión de cambios mientras se mantiene la documentación del incidente para su revisión.

Documentación y Aprendizaje

Cada incidente genera documentación que incluye la línea de tiempo, la evaluación del impacto, la causa raíz y las acciones preventivas. Estos aprendizajes retroalimentan nuestro registro de riesgos y la planificación de prevención de amenazas.

Nuestros procedimientos de gestión de incidentes se alinean con nuestro marco general de SGSI y respaldan los requisitos de cumplimiento de SOC 2, ISO 27001 y NIST.

On this page