Moderazione dei Contenuti e Sicurezza - ISMS Copilot
ISMS Copilot utilizza la moderazione automatica dei contenuti per rilevare e prevenire contenuti inappropriati o dannosi nei messaggi di chat. Questo processo viene eseguito in background per mantenere un ambiente sicuro e conforme per tutti gli utenti, preservando la tua privacy e la velocità del flusso di lavoro.
ISMS Copilot utilizza la moderazione automatica dei contenuti per rilevare e prevenire contenuti inappropriati o dannosi nei messaggi di chat. Questo processo viene eseguito in background per mantenere un ambiente sicuro e conforme per tutti gli utenti, preservando la tua privacy e la velocità del flusso di lavoro.
La moderazione viene eseguita in modo asincrono dopo l'invio di un messaggio — non aggiunge alcuna latenza alla tua esperienza di chat.
Come Funziona la Moderazione
Quando invii un messaggio di chat, ISMS Copilot lo salva immediatamente e fornisce la risposta dell'IA senza ritardi. Parallelamente, viene eseguito un controllo di moderazione dei contenuti in background:
- Messaggio analizzato — Il tuo messaggio viene inviato a un'API di moderazione (OpenAI per impostazione predefinita, Mistral AI per gli utenti con Protezione Avanzata dei Dati)
- Categorie verificate — L'API analizza la presenza di violazioni delle policy, tra cui discorsi d'odio, molestie, violenza, autolesionismo e altri contenuti dannosi
- Risultato registrato — Il risultato della moderazione viene memorizzato nei nostri registri di audit con punteggi delle categorie e timestamp
- Amministratori allertati — Se il contenuto viene segnalato, il nostro team riceve un avviso automatico per la revisione
Questo processo è completamente automatizzato e "fire-and-forget" — la tua chat continua senza interruzioni.
Fornitori di Moderazione
ISMS Copilot utilizza diverse API di moderazione in base alle tue impostazioni di protezione dei dati:
- OpenAI Moderation API — Predefinita per tutti gli utenti. Verifica la presenza di: contenuti sessuali, odio, molestie, violenza, autolesionismo
- Mistral AI Moderation API — Utilizzata quando è abilitata la Protezione Avanzata dei Dati. Verifica la presenza di: contenuti sessuali, odio e discriminazione, violenza e minacce, contenuti pericolosi e criminali, autolesionismo, salute, finanza, legge, informazioni personali identificabili (PII)
Le categorie di Mistral includono controlli su salute, finanza, legge e PII. Questi potrebbero occasionalmente segnalare discussioni legittime sulla conformità ISMS. Il nostro team esamina tutti gli avvisi per evitare falsi positivi.
Protezione Avanzata dei Dati e Moderazione
Se hai abilitato la Protezione Avanzata dei Dati, i tuoi messaggi di chat normalmente non vengono memorizzati sui nostri server o inviati a fornitori di IA di terze parti. Tuttavia, la moderazione dei contenuti rappresenta un'eccezione:
- Messaggi puliti — Il contenuto del messaggio NON viene memorizzato; vengono conservati solo i metadati e i punteggi di moderazione per 30 giorni
- Messaggi segnalati — Il contenuto completo viene sempre memorizzato per 1 anno e incluso negli avvisi agli amministratori, indipendentemente dall'impostazione ADP
Sovrascrittura per la sicurezza: I contenuti segnalati vengono sempre memorizzati e condivisi con il nostro team, anche con la Protezione Avanzata dei Dati abilitata. Questo è necessario per la conformità legale, la prevenzione degli abusi e il mantenimento della sicurezza della piattaforma per tutti gli utenti.
Questa sovrascrittura si basa su un interesse legittimo ai sensi dell'Articolo 6(1)(f) del GDPR — prevenire danni e applicare la nostra Politica di Utilizzo Accettabile rappresenta un interesse legittimo che prevale sulle preferenze individuali di protezione dei dati nei casi segnalati.
Conservazione dei Dati
Gli eventi di moderazione vengono conservati secondo il seguente programma:
- Eventi non segnalati — Metadati e punteggi di moderazione conservati per 30 giorni; il contenuto del messaggio NON viene memorizzato
- Eventi segnalati — Contenuto completo del messaggio e metadati conservati per 1 anno per scopi di audit e conformità legale
Il contenuto dei messaggi segnalati può essere conservato più a lungo se richiesto per indagini in corso, procedimenti legali o obblighi normativi.
Cosa Succede Quando un Contenuto Viene Segnalato
Quando l'API di moderazione segnala il tuo messaggio come potenzialmente in violazione delle nostre policy:
- Avviso inviato — Il nostro team di amministratori riceve una notifica via webhook con le categorie segnalate, il timestamp e un'anteprima del messaggio
- Revisione umana — Un membro del team esamina il messaggio e il contesto per confermare se viola la nostra Politica di Utilizzo Accettabile
- Azione (se confermato) — Potremmo contattarti, emettere un avviso, sospendere funzionalità o terminare il tuo account a seconda della gravità e delle violazioni ripetute
- Falsi positivi — Se la segnalazione era errata (ad esempio, una discussione legittima sulla conformità), non viene intrapresa alcuna azione
Limitazione della frequenza: Puoi attivare un solo avviso di moderazione all'ora. I messaggi segnalati successivi entro quella finestra vengono registrati ma non generano avvisi duplicati.
Privacy e Trasparenza
Siamo impegnati nella trasparenza riguardo alle nostre pratiche di moderazione:
- Nessuna censura silenziosa — Non blocchiamo o filtriamo i tuoi messaggi in tempo reale. La moderazione serve per l'applicazione della sicurezza, non per il controllo dei contenuti
- Processori di terze parti — OpenAI (con sede negli Stati Uniti) e Mistral AI (con sede in Francia) agiscono come sub-processori solo per la moderazione. Consulta il nostro Registro delle Attività di Trattamento per i dettagli
- Piena divulgazione — Questa policy e la nostra Informativa sulla Privacy documentano tutti i flussi di dati di moderazione e le basi legali
Base Legale
La moderazione dei contenuti si basa su:
- Interesse legittimo (Art. 6(1)(f) GDPR) — Prevenire abusi, applicare i nostri termini e mantenere la sicurezza della piattaforma
- Necessità contrattuale (Art. 6(1)(b) GDPR) — Applicare i nostri Termini di Servizio e la Politica di Utilizzo Accettabile
- Obbligo legale (Art. 6(1)(c) GDPR) — Rispettare le leggi applicabili che richiedono la rimozione o la segnalazione di contenuti illegali
I Tuoi Diritti
Ai sensi del GDPR, hai diritti riguardo ai tuoi dati di moderazione:
- Accesso — Richiedere copie degli eventi di moderazione associati al tuo account
- Rettifica — Richiedere la correzione di record di moderazione inaccurati
- Cancellazione — Richiedere la cancellazione dei dati di moderazione non segnalati (i dati segnalati possono essere conservati per conformità legale)
- Opposizione — Opporsi al trattamento di moderazione, sebbene possiamo continuare se abbiamo motivi legittimi cogenti (sicurezza, obblighi legali)
Per esercitare i tuoi diritti o porre domande sulla moderazione, contattaci all'indirizzo contact@ismscopilot.com.
Domande?
Per ulteriori informazioni sulle nostre pratiche di privacy e sicurezza, consulta: