Bevorstehende Plattformverbesserungen
Wir arbeiten an mehreren Verbesserungen, um Ihre Erfahrung mit ISMS Copilot schneller, kostengünstiger und einfacher zu gestalten – insbesondere bei langen Gesprächen.
Wir arbeiten an mehreren Verbesserungen, um Ihre Erfahrung mit ISMS Copilot schneller, kostengünstiger und einfacher zu gestalten – insbesondere bei langen Gesprächen.
Aktualisierung: Nachrichtenverdichtung ist jetzt für den Think-Modus live! Die automatische Gesprächsverdichtung ermöglicht unbegrenzte Think-Modus-Gespräche ohne Token-Limit. Wenn die Schwelle von ~150.000 Token erreicht wird, fasst das System ältere Nachrichten im Hintergrund automatisch zusammen, sodass Sie nahtlos weitermachen können. Weitere Details finden Sie im Produkt-Changelog.
Nachrichtenverdichtung – Jetzt für den Think-Modus verfügbar ✓
Die automatische Gesprächsverdichtung ist jetzt für den Think-Modus (Claude Opus 4.6) verfügbar. Wenn Ihr Think-Modus-Gespräch das Kontextlimit erreicht, fasst das Backend ältere Nachrichten automatisch zusammen, während der wichtige Kontext erhalten bleibt, sodass Sie unbegrenzt weitermachen können.
Was jetzt funktioniert:
- Unbegrenzte Think-Modus-Gespräche: Keine „Gespräch zu lang“-Fehler mehr im Think-Modus
- Automatische Zusammenfassung: Das Backend verdichtet ältere Nachrichten, wenn ~150.000 Token erreicht werden
- Visuelles Feedback: Ein kurzer Hinweis „Verdichte unser Gespräch...“ erscheint während des Vorgangs
- Nahtloses Erlebnis: Gespräche werden nach wenigen Sekunden normal fortgesetzt, wobei der volle Kontext erhalten bleibt
Noch in Arbeit:
- Fast-Modus-Unterstützung: Verdichtung für den Fast-Modus und andere KI-Modelle folgt in Kürze
- Nutzungsoptimierung: Weitere Reduzierungen des Token-Verbrauchs für lange Gespräche in allen Modi
Weitere Verbesserungen für lange Gespräche
Zusätzlich zur Verdichtung arbeiten wir an:
- Warnungen im Chat, wenn ein Gespräch erhebliche Credits verbraucht, mit intelligenten Vorschlägen, wann die Verdichtung hilft und wann ein neues Gespräch begonnen werden sollte
- Klarere Token-Nutzungsinformationen, damit Sie genau sehen können, wie viel jede Nachricht kostet und warum
- Visuelle Indikatoren, die den Zustand des Gesprächs und den Verdichtungsstatus anzeigen
Intelligentere Dokumentenerkennung
Jede Nachricht löst derzeit eine separate Überprüfung aus, um festzustellen, ob Sie eine Dokumentenanalyse anfordern. Wir optimieren diesen Prozess, um unnötige Überprüfungen zu überspringen und den Hintergrund-Token-Verbrauch zu reduzieren, den Sie nie sehen.
Faireres Abrechnungsmodell
Wir prüfen, ob wir nur für neue Inhalte (Ihre letzte Nachricht und die Antwort der KI) abrechnen sollten, anstatt für den gesamten Gesprächsverlauf, der mit jeder Nachricht erneut gesendet wird. Dies würde lange Gespräche deutlich erschwinglicher machen.
Diese Verbesserungen befinden sich in der Entwicklung. Wir werden diesen Artikel aktualisieren und Nutzer informieren, sobald die Funktionen ausgerollt werden.
Wann werden diese Änderungen eingeführt?
Die Nachrichtenverdichtung für den Think-Modus ist jetzt live. Weitere Verbesserungen, einschließlich Fast-Modus-Unterstützung, Optimierung der Dokumentenerkennung und Änderungen am Abrechnungsmodell, sind aktiv in Arbeit.
Haben Sie Fragen oder Vorschläge? Kontaktieren Sie unser Support-Team – wir hören zu.