ISMS Copilot Docs

Content Moderatie & Veiligheid - ISMS Copilot

ISMS Copilot maakt gebruik van geautomatiseerde contentmoderatie om ongepaste of schadelijke inhoud in chatberichten te detecteren en te voorkomen. Dit proces draait op de achtergrond…

ISMS Copilot maakt gebruik van geautomatiseerde contentmoderatie om ongepaste of schadelijke inhoud in chatberichten te detecteren en te voorkomen. Dit proces draait op de achtergrond om een veilige, compliant omgeving voor alle gebruikers te behouden, terwijl uw privacy en workflowsnelheid worden gewaarborgd.

Moderatie wordt asynchroon uitgevoerd nadat u een bericht verzendt — het voegt geen vertraging toe aan uw chatervaring.

Hoe Moderatie Werkt

Wanneer u een chatbericht verzendt, slaat ISMS Copilot dit direct op en levert uw AI-antwoord zonder vertraging. Tegelijkertijd wordt er op de achtergrond een contentmoderatiecontrole uitgevoerd:

  1. Bericht geanalyseerd — Uw bericht wordt verzonden naar een moderatie-API (standaard OpenAI, Mistral AI voor gebruikers met Geavanceerde Gegevensbescherming)
  2. Categorieën gecontroleerd — De API scant op beleidsschendingen, waaronder haatzaaien, intimidatie, geweld, zelfbeschadiging en andere schadelijke inhoud
  3. Resultaat geregistreerd — Het moderatieresultaat wordt opgeslagen in onze auditlogs met categoriewaarden en tijdstempels
  4. Beheerders gewaarschuwd — Als inhoud wordt gemarkeerd, ontvangt ons team een geautomatiseerde melding voor beoordeling

Dit proces is volledig geautomatiseerd en "fire-and-forget" — uw chat gaat zonder onderbreking verder.

Moderatieproviders

ISMS Copilot gebruikt verschillende moderatie-API's op basis van uw gegevensbeschermingsinstellingen:

  • OpenAI Moderation API — Standaard voor alle gebruikers. Controleert op: seksuele inhoud, haat, intimidatie, geweld, zelfbeschadiging
  • Mistral AI Moderation API — Wordt gebruikt wanneer Geavanceerde Gegevensbescherming is ingeschakeld. Controleert op: seksuele inhoud, haat en discriminatie, geweld en bedreigingen, gevaarlijke en criminele inhoud, zelfbeschadiging, gezondheid, financieel, recht, persoonlijk identificeerbare informatie (PII)

De categorieën van Mistral omvatten controles op gezondheid, financieel, recht en PII. Deze kunnen af en toe legitieme ISMS-compliance discussies markeren. Ons team beoordeelt alle meldingen om valse positieven te voorkomen.

Geavanceerde Gegevensbescherming en Moderatie

Als u Geavanceerde Gegevensbescherming heeft ingeschakeld, worden uw chatberichten normaal gesproken niet opgeslagen op onze servers of verzonden naar externe AI-aanbieders. Contentmoderatie vormt echter één uitzondering:

  • Schone berichten — Berichtinhoud NIET opgeslagen; alleen metadata en moderatiescores worden 30 dagen bewaard
  • Gemarkeerde berichten — Volledige inhoud wordt altijd 1 jaar opgeslagen en opgenomen in beheerdersmeldingen, ongeacht de ADP-instelling

Veiligheidsoverschrijding: Gemarkeerde inhoud wordt altijd opgeslagen en gedeeld met ons team, zelfs wanneer Geavanceerde Gegevensbescherming is ingeschakeld. Dit is noodzakelijk voor wettelijke naleving, het voorkomen van misbruik en het handhaven van platformveiligheid voor alle gebruikers.

Deze overschrijding is gebaseerd op gerechtvaardigd belang volgens GDPR Artikel 6(1)(f) — het voorkomen van schade en het handhaven van ons Acceptabel Gebruiksbeleid is een gerechtvaardigd belang dat in gemarkeerde gevallen individuele gegevensbeschermingsvoorkeuren overstijgt.

Gegevensbewaring

Moderatiegebeurtenissen worden bewaard volgens het volgende schema:

  • Niet-gemarkeerde gebeurtenissen — Metadata en moderatiescores worden 30 dagen bewaard; berichtinhoud wordt NIET opgeslagen
  • Gemarkeerde gebeurtenissen — Volledige berichtinhoud en metadata worden 1 jaar bewaard voor audit- en wettelijke nalevingsdoeleinden

Gemarkeerde berichtinhoud kan langer worden bewaard als dit nodig is voor lopende onderzoeken, juridische procedures of wettelijke verplichtingen.

Wat Gebeurt Er Bij Gemarkeerde Inhoud

Wanneer de moderatie-API uw bericht markeert als mogelijk in strijd met ons beleid:

  1. Melding verzonden — Ons beheerders team ontvangt een webhook-melding met de gemarkeerde categorieën, tijdstempel en berichtvoorbeeld
  2. Menselijke beoordeling — Een teamlid beoordeelt het bericht en de context om te bevestigen of het in strijd is met ons Acceptabel Gebruiksbeleid
  3. Actie (indien bevestigd) — Afhankelijk van de ernst en herhaalde overtredingen kunnen we contact met u opnemen, een waarschuwing geven, functies opschorten of uw account beëindigen
  4. Valse positieven — Als de markering onjuist was (bijv. een legitieme compliance-discussie), wordt er geen actie ondernomen

Snelheidsbeperking: U kunt slechts één moderatiemelding per uur activeren. Daaropvolgende gemarkeerde berichten binnen dat tijdvenster worden geregistreerd, maar genereren geen dubbele meldingen.

Privacy en Transparantie

Wij zijn toegewijd aan transparantie over onze moderatiepraktijken:

  • Geen stille censuur — We blokkeren of filteren uw berichten niet in realtime. Moderatie dient voor veiligheidshandhaving, niet voor inhoudscontrole
  • Externe verwerkers — OpenAI (VS-gebaseerd) en Mistral AI (Frankrijk-gebaseerd) fungeren als onderverwerkers uitsluitend voor moderatie. Zie ons Register van Verwerkingsactiviteiten voor details
  • Volledige openheid — Dit beleid en ons Privacybeleid documenteren alle moderatiegegevensstromen en juridische grondslagen

Juridische Grondslag

Contentmoderatie is gebaseerd op:

  • Gerechtvaardigd belang (GDPR Art. 6(1)(f)) — Voorkomen van misbruik, handhaven van onze voorwaarden en behouden van platformveiligheid
  • Contractuele noodzaak (GDPR Art. 6(1)(b)) — Handhaven van onze Gebruiksvoorwaarden en Acceptabel Gebruiksbeleid
  • Wettelijke verplichting (GDPR Art. 6(1)(c)) — Voldoen aan toepasselijke wetgeving die verwijdering of melding van illegale inhoud vereist

Uw Rechten

Onder de GDPR heeft u rechten met betrekking tot uw moderatiegegevens:

  • Toegang — Vraag kopieën op van moderatiegebeurtenissen die aan uw account zijn gekoppeld
  • Rectificatie — Vraag correctie aan van onjuiste moderatieregistraties
  • Wissen — Vraag verwijdering aan van niet-gemarkeerde moderatiegegevens (gemarkeerde gegevens kunnen worden bewaard voor wettelijke naleving)
  • Bezwaar — Maak bezwaar tegen moderatieverwerking, hoewel wij kunnen doorgaan als wij dwingende gerechtvaardigde gronden hebben (veiligheid, wettelijke verplichtingen)

Om uw rechten uit te oefenen of vragen te stellen over moderatie, neem contact met ons op via contact@ismscopilot.com.

Vragen?

Voor meer informatie over onze privacy- en veiligheidspraktijken, zie:

On this page