ISMS Copilot Docs

Inhaltsmoderation & Sicherheit - ISMS Copilot

ISMS Copilot nutzt automatisierte Inhaltsmoderation, um unangemessene oder schädliche Inhalte in Chat-Nachrichten zu erkennen und zu verhindern. Dieser Prozess läuft im Hintergrund, um eine sichere, konforme Umgebung für alle Nutzer zu gewährleisten und gleichzeitig Ihre Privatsphäre und Arbeitsgeschwindigkeit zu schützen.

ISMS Copilot nutzt automatisierte Inhaltsmoderation, um unangemessene oder schädliche Inhalte in Chat-Nachrichten zu erkennen und zu verhindern. Dieser Prozess läuft im Hintergrund, um eine sichere, konforme Umgebung für alle Nutzer zu gewährleisten und gleichzeitig Ihre Privatsphäre und Arbeitsgeschwindigkeit zu schützen.

Die Moderation erfolgt asynchron nach dem Versand einer Nachricht – sie fügt Ihrer Chat-Erfahrung keine Latenz hinzu.

Funktionsweise der Moderation

Wenn Sie eine Chat-Nachricht senden, speichert ISMS Copilot diese sofort und liefert Ihre KI-Antwort ohne Verzögerung. Parallel dazu wird im Hintergrund eine Inhaltsmoderationsprüfung durchgeführt:

  1. Nachricht analysiert — Ihre Nachricht wird an eine Moderations-API gesendet (standardmäßig OpenAI, Mistral AI für Nutzer mit Erweiterter Datenschutzfunktion)
  2. Kategorien geprüft — Die API durchsucht die Nachricht nach Verstößen gegen Richtlinien, einschließlich Hassrede, Belästigung, Gewalt, Selbstgefährdung und anderen schädlichen Inhalten
  3. Ergebnis protokolliert — Das Moderationsergebnis wird in unseren Audit-Logs mit Kategoriescores und Zeitstempeln gespeichert
  4. Admins benachrichtigt — Bei markierten Inhalten erhält unser Team eine automatisierte Benachrichtigung zur Überprüfung

Dieser Prozess ist vollständig automatisiert und erfolgt nach dem „Fire-and-Forget“-Prinzip – Ihr Chat läuft ohne Unterbrechung weiter.

Moderationsanbieter

ISMS Copilot verwendet unterschiedliche Moderations-APIs, abhängig von Ihren Datenschutzeinstellungen:

  • OpenAI Moderation API — Standard für alle Nutzer. Prüft auf: sexuelle Inhalte, Hass, Belästigung, Gewalt, Selbstgefährdung
  • Mistral AI Moderation API — Wird verwendet, wenn Erweiterter Datenschutz aktiviert ist. Prüft auf: sexuelle Inhalte, Hass und Diskriminierung, Gewalt und Bedrohungen, gefährliche und kriminelle Inhalte, Selbstgefährdung, Gesundheit, Finanzen, Recht, personenbezogene Daten (PII)

Mistrals Kategorien umfassen Prüfungen zu Gesundheit, Finanzen, Recht und PII. Diese können gelegentlich legitime ISMS-Compliance-Diskussionen markieren. Unser Team überprüft alle Benachrichtigungen, um Fehlalarme zu vermeiden.

Erweiterter Datenschutz und Moderation

Wenn Sie Erweiterter Datenschutzmodus aktiviert haben, werden Ihre Chat-Nachrichten normalerweise nicht auf unseren Servern gespeichert oder an Drittanbieter-KI-Dienste gesendet. Die Inhaltsmoderation stellt jedoch eine Ausnahme dar:

  • Unauffällige Nachrichten — Nachrichteninhalte werden NICHT gespeichert; nur Metadaten und Moderationsscores werden für 30 Tage aufbewahrt
  • Markierte Nachrichten — Vollständige Inhalte werden immer für 1 Jahr gespeichert und in Admin-Benachrichtigungen aufgenommen, unabhängig von der ADP-Einstellung

Sicherheitsüberschreibung: Markierte Inhalte werden immer gespeichert und unserem Team zur Verfügung gestellt, selbst wenn Erweiterter Datenschutz aktiviert ist. Dies ist notwendig für die rechtliche Compliance, Missbrauchsprävention und die Aufrechterhaltung der Plattformsicherheit für alle Nutzer.

Diese Überschreibung basiert auf einem berechtigten Interesse gemäß DSGVO Artikel 6(1)(f) – die Verhinderung von Schäden und die Durchsetzung unserer Richtlinie zur akzeptablen Nutzung stellen ein berechtigtes Interesse dar, das in markierten Fällen individuelle Datenschutzpräferenzen überwiegt.

Datenspeicherung

Moderationsereignisse werden nach folgendem Zeitplan aufbewahrt:

  • Nicht markierte Ereignisse — Metadaten und Moderationsscores werden für 30 Tage aufbewahrt; Nachrichteninhalte werden NICHT gespeichert
  • Markierte Ereignisse — Vollständige Nachrichteninhalte und Metadaten werden für 1 Jahr zu Audit- und rechtlichen Compliance-Zwecken aufbewahrt

Markierte Nachrichteninhalte können länger aufbewahrt werden, wenn dies für laufende Untersuchungen, rechtliche Verfahren oder regulatorische Verpflichtungen erforderlich ist.

Was passiert bei markierten Inhalten

Wenn die Moderations-API Ihre Nachricht als potenziellen Verstoß gegen unsere Richtlinien markiert:

  1. Benachrichtigung gesendet — Unser Admin-Team erhält eine Webhook-Benachrichtigung mit den markierten Kategorien, dem Zeitstempel und einer Vorschau der Nachricht
  2. Manuelle Überprüfung — Ein Teammitglied überprüft die Nachricht und den Kontext, um festzustellen, ob sie gegen unsere Richtlinie zur akzeptablen Nutzung verstößt
  3. Maßnahme (bei Bestätigung) — Je nach Schwere und Wiederholung von Verstößen können wir Sie kontaktieren, eine Verwarnung aussprechen, Funktionen sperren oder Ihr Konto kündigen
  4. Fehlalarme — Wenn die Markierung falsch war (z. B. bei einer legitimen Compliance-Diskussion), wird keine Maßnahme ergriffen

Ratenbegrenzung: Sie können nur einmal pro Stunde eine Moderationsbenachrichtigung auslösen. Weitere markierte Nachrichten innerhalb dieses Zeitfensters werden protokolliert, lösen jedoch keine doppelten Benachrichtigungen aus.

Privatsphäre und Transparenz

Wir setzen uns für Transparenz bei unseren Moderationspraktiken ein:

  • Keine stille Zensur — Wir blockieren oder filtern Ihre Nachrichten nicht in Echtzeit. Die Moderation dient der Durchsetzung von Sicherheitsmaßnahmen, nicht der Inhaltskontrolle
  • Drittanbieter als Auftragsverarbeiter — OpenAI (US-basiert) und Mistral AI (Frankreich-basiert) fungieren ausschließlich als Unterauftragsverarbeiter für die Moderation. Weitere Details finden Sie in unserem Verzeichnis der Verarbeitungstätigkeiten
  • Vollständige Offenlegung — Diese Richtlinie und unsere Datenschutzrichtlinie dokumentieren alle Datenflüsse im Zusammenhang mit der Moderation sowie die rechtlichen Grundlagen

Rechtliche Grundlage

Die Inhaltsmoderation basiert auf:

  • Berechtigtes Interesse (DSGVO Art. 6(1)(f)) — Verhinderung von Missbrauch, Durchsetzung unserer Nutzungsbedingungen und Aufrechterhaltung der Plattformsicherheit
  • Vertragliche Notwendigkeit (DSGVO Art. 6(1)(b)) — Durchsetzung unserer Nutzungsbedingungen und Richtlinie zur akzeptablen Nutzung
  • Rechtliche Verpflichtung (DSGVO Art. 6(1)(c)) — Einhaltung geltender Gesetze, die die Entfernung oder Meldung illegaler Inhalte vorschreiben

Ihre Rechte

Gemäß der DSGVO haben Sie folgende Rechte in Bezug auf Ihre Moderationsdaten:

  • Auskunft — Anforderung von Kopien der Moderationsereignisse, die Ihrem Konto zugeordnet sind
  • Berichtigung — Anforderung der Korrektur ungenauer Moderationsaufzeichnungen
  • Löschung — Anforderung der Löschung nicht markierter Moderationsdaten (markierte Daten können aus rechtlichen Gründen aufbewahrt werden)
  • Widerspruch — Widerspruch gegen die Verarbeitung von Moderationsdaten, wobei wir diese fortsetzen können, wenn wir zwingende berechtigte Gründe (Sicherheit, rechtliche Verpflichtungen) haben

Um Ihre Rechte auszuüben oder Fragen zur Moderation zu stellen, kontaktieren Sie uns unter contact@ismscopilot.com.

Fragen?

Weitere Informationen zu unseren Datenschutz- und Sicherheitspraktiken finden Sie unter:

On this page