ISMS Copilot Docs

Fehler: Unterhaltung zu lang

Wenn Sie die Meldung „Ihre Unterhaltung ist zu lang. Bitte starten Sie eine neue Unterhaltung, um fortzufahren.“ oder „Der KI-Dienst ist auf einen Fehler gestoßen. Bitte versuchen Sie es erneut.“ beim Senden…

Wenn Sie die Meldung „Ihre Unterhaltung ist zu lang. Bitte starten Sie eine neue Unterhaltung, um fortzufahren.“ oder „Der KI-Dienst ist auf einen Fehler gestoßen. Bitte versuchen Sie es erneut.“ beim Senden einer Nachricht sehen, haben Sie die maximale Länge der Unterhaltung erreicht, die die KI verarbeiten kann.

Was ist passiert?

Die kombinierte Größe Ihres Unterhaltungsverlaufs, hochgeladener Dateien und der aktuellen Nachricht hat das Kontextfenster-Limit des KI-Modells überschritten. Dieses technische Limit beträgt 200.000 Token (etwa 500 Seiten Text oder 800.000 Zeichen).

Stellen Sie es sich wie das „Arbeitsgedächtnis“ der KI vor – sobald die Unterhaltung zu lang wird, kann die KI nicht mehr alle Informationen auf einmal verarbeiten.

Warum ist das passiert?

Dieser Fehler tritt typischerweise auf, wenn Sie:

Einen langen Unterhaltungsverlauf haben

Unterhaltungen mit 100+ Nachrichten, insbesondere detaillierte Hin-und-Her-Diskussionen zu komplexen Compliance-Themen, können beträchtlichen Kontext ansammeln.

Große Datei-Uploads

Dateien verbrauchen einen großen Teil des Kontextlimits, insbesondere:

  • Mehrblatt-Tabellen – Große Excel-Dateien mit umfangreichen Kontrollmatrizen oder detaillierten Anforderungen können bei der Verarbeitung in 100+ Teile aufgeteilt werden
  • Lange PDF-Dokumente – Vollständige Richtlinienhandbücher, Standarddokumentationen oder Prüfberichte
  • Mehrere Dokument-Uploads – Mehrere Dateien, die im Laufe der Unterhaltung hochgeladen wurden

Eine Kombination aus beidem

Längere Unterhaltungen mit vielen Nachrichten in Kombination mit großen Datei-Uploads können schnell 200.000 Token überschreiten, selbst wenn jede einzelne Nachricht angemessen erscheint.

Beispiel: Eine umfassende Compliance-Tabelle (wie eine detaillierte Kontrollmatrix oder ein Dokument mit Anforderungen für mehrere Frameworks) kann bei der Verarbeitung in 100+ Teile aufgeteilt werden. In Kombination mit einem langen Unterhaltungsverlauf und zusätzlichen Dokument-Uploads kann dies leicht dazu führen, dass die Gesamtzahl der Token das Limit von 200.000 überschreitet.

Wie kann man das beheben?

1. Eine neue Unterhaltung starten (empfohlen)

Ihre vorherige Unterhaltung wird automatisch gespeichert und ist jederzeit zugänglich. Starten Sie einfach eine neue Unterhaltung, um Ihre Arbeit fortzusetzen.

Schritte:

  1. Klicken Sie auf das ISMS Copilot-Logo (oben links), um zum Willkommensbildschirm zurückzukehren
  2. Beginnen Sie, Ihre nächste Frage in einer neuen Unterhaltung einzugeben
  3. Ihre alte Unterhaltung bleibt in Ihrem Verlauf und Arbeitsbereich erhalten

2. Vorherigen Kontext zusammenfassen

Wenn Sie auf frühere Arbeiten Bezug nehmen müssen, kopieren Sie die wichtigsten Erkenntnisse aus Ihrer langen Unterhaltung und fügen Sie sie in Ihren neuen Chat ein.

Beispiel:

„Basierend auf unserer vorherigen Lückenanalyse haben wir 12 fehlende ISO 27001-Kontrollen in Anhang A.8 (Asset Management) identifiziert. Wir implementieren ein CMDB für A.8.1. Jetzt brauche ich Hilfe mit A.8.2 (Informationsklassifizierung)...“

Dies gibt der KI den benötigten Kontext, ohne den gesamten Unterhaltungsverlauf laden zu müssen.

3. Kleinere oder weniger Dateien hochladen

Seien Sie in Ihrer neuen Unterhaltung strategisch bei Datei-Uploads:

  • Große Dokumente in Abschnitte unterteilen – Laden Sie nur die relevanten Seiten oder Registerkarten hoch, die analysiert werden müssen
  • Jeweils eine Datei hochladen – Analysieren Sie das erste Dokument, dann starten Sie eine neue Unterhaltung für das nächste
  • Große Tabellen umwandeln – Extrahieren Sie spezifische Arbeitsblätter in separate Dateien, anstatt ganze Arbeitsmappen hochzuladen
  • Unnötige Inhalte entfernen – Löschen Sie Deckblätter, Bilder oder Anhänge, die für die Analyse nicht benötigt werden

Bei großen Compliance-Tabellen mit mehreren Registerkarten oder Anforderungsbereichen laden Sie nur die spezifischen Abschnitte hoch, an denen Sie arbeiten, anstatt die gesamte Arbeitsmappe.

4. Separate Unterhaltungen für verschiedene Themen verwenden

Erstellen Sie statt einer langen Unterhaltung, die alles abdeckt, fokussierte Unterhaltungen:

  • Eine Unterhaltung pro Kontrollbereich – Separate Chats für Zugriffskontrolle (A.5), Kryptographie (A.8), Physische Sicherheit (A.7) usw.
  • Eine Unterhaltung pro Dokument – Analysieren Sie jede Richtlinie oder jedes Verfahren in einem eigenen Thread
  • Eine Unterhaltung pro Prüfungsbereich – Halten Sie die Vorbereitung vor der Prüfung getrennt von der Nachbearbeitung nach der Prüfung

Dieser Ansatz erleichtert es auch, spezifische Diskussionen später wiederzufinden.

Best Practices, um diesen Fehler zu vermeiden

Für Berater, die Kundenprojekte verwalten

  • Erstellen Sie separate Arbeitsbereiche für jeden Kunden
  • Verwenden Sie innerhalb jedes Arbeitsbereichs separate Unterhaltungen für verschiedene Phasen (Lückenanalyse, Implementierung, Prüfungsvorbereitung)
  • Exportieren Sie wichtige Erkenntnisse regelmäßig in Ihre eigene Dokumentation

Für ISO 27001-Implementierungen

  • Erstellen Sie eine Unterhaltung pro Anhang-A-Kontrollkategorie
  • Generieren Sie Richtlinien in fokussierten Sitzungen, anstatt alles auf einmal
  • Halten Sie Risikobewertungen in einer separaten Unterhaltung von der Kontrollimplementierung

Für Dokumentenanalyse

  • Laden Sie jeweils eine Richtlinie hoch und analysieren Sie sie
  • Erstellen Sie für die Lückenanalyse mehrerer Dokumente separate Unterhaltungen für jedes Dokument
  • Fassen Sie Erkenntnisse aus vorherigen Analysen zusammen, anstatt Dateien erneut hochzuladen

Automatische Komprimierung für den Think-Modus

Gute Nachricht: Die automatische Unterhaltungskomprimierung ist jetzt für den Think-Modus (Claude Opus 4.6) verfügbar. Wenn Ihre Think-Modus-Unterhaltung sich dem Kontextlimit nähert, fasst das System ältere Nachrichten im Hintergrund automatisch zusammen, sodass Sie unbegrenzt weiterarbeiten können, ohne einen neuen Chat starten zu müssen.

So funktioniert es:

  • Automatische Zusammenfassung: Wenn im Think-Modus etwa 150.000 Token erreicht werden, komprimiert das Backend ältere Nachrichten, während der wichtige Kontext erhalten bleibt
  • Visueller Indikator: Sie sehen eine kurze Fortschrittsmeldung „Unsere Unterhaltung wird komprimiert...“ (gelber Indikator) während des Vorgangs
  • Nahtlose Fortsetzung: Nach einigen Sekunden wird Ihre Unterhaltung normal fortgesetzt, wobei der volle Kontext erhalten bleibt
  • Unendliche Unterhaltungen: Keine manuellen Neustarts mehr für ausgedehnte Compliance-Diskussionen, Lückenanalysen oder Richtlinienüberprüfungen

Nur Think-Modus: Die Komprimierung ist derzeit ausschließlich für den Think-Modus (Claude Opus 4.6) verfügbar. Der Fast-Modus und andere KI-Modelle haben weiterhin die standardmäßigen Unterhaltungslängenlimits. Für lange, komplexe Compliance-Arbeiten, die erweiterten Kontext erfordern, wechseln Sie zum Think-Modus.

Für andere Modi: Wenn Sie den Fast-Modus oder andere KI-Modelle verwenden und auf das Unterhaltungslängenlimit stoßen, bleibt das Starten einer neuen Unterhaltung der empfohlene Ansatz. Ihre vorherige Unterhaltung wird automatisch gespeichert und ist jederzeit zugänglich.

Token-Limits verstehen

Verschiedene KI-Modelle haben unterschiedliche Kontextfenstergrößen:

  • Claude Opus 4.5: 200.000 Token (~500 Seiten)
  • Mistral Medium: 128.000 Token (~320 Seiten)

Was zum Limit zählt:

  • Jede Nachricht, die Sie senden
  • Jede KI-Antwort
  • Alle Inhalte hochgeladener Dateien (aus PDFs, Tabellen usw. extrahierter Text)
  • Systemaufforderungen und Framework-Wissen (geringfügig, aber vorhanden)

Token-Schätzung: Als grobe Richtlinie entspricht 1 Token etwa 4 Zeichen Text. Somit entsprechen 200.000 Token etwa 800.000 Zeichen oder 500 Seiten typischer Geschäftsdokumente.

Hilfe erhalten

Wenn Sie regelmäßig an dieses Limit stoßen oder Hilfe beim Wiederherstellen des Kontexts aus einer sehr langen Unterhaltung benötigen:

  1. Kontaktieren Sie den Support über Benutzermenü → Hilfe-Center → Support kontaktieren
  2. Geben Sie den Titel der Unterhaltung oder den Namen des Arbeitsbereichs an
  3. Erklären Sie, woran Sie gearbeitet haben und welchen Kontext Sie erhalten möchten
  4. Wir können Ihnen helfen, wichtige Informationen zu extrahieren und Ihre Arbeit in überschaubare Unterhaltungen zu strukturieren

Januar 2026: Wir haben ein Backend-Tracking implementiert, um Benutzer zu identifizieren, die von diesem Fehler betroffen sind, sodass unser Support-Team schneller und gezielter helfen kann.

Verwandte Ressourcen

On this page