Was Delegation spart (und was nicht)
Wie die Übertragung von GRC-Arbeiten an ISMS Copilot über MCP den Kontext aus dem Transkript Ihres Agents heraushält, wofür Ihr Agent weiterhin zahlt, was die Nutzungsquittung anzeigt und wo die Nutzung von ISMS Copilot abgerechnet wird.
Wenn Ihr Coding-Agent eine Compliance-Frage an ISMS Copilot delegiert, wird ein Teil der Arbeit auf der Seite von ISMS Copilot erledigt, anstatt im Kontext Ihres Agents. Diese Seite erklärt den Mechanismus, was sich nicht ändert und wie die Abrechnung für beide Seiten erfolgt. Es wird kein Anspruch auf die Höhe der Einsparungen erhoben: Das hängt von Ihrem Orchestrator, Ihrem Modell und Ihrer Arbeit ab.
Warum der Kontext Ihres Agents wichtig ist
Ein chatbasierter Agent speichert frühere Dialogschritte nicht selbstständig. Bei jedem Schritt sendet ein typischer Orchestrator dem Modell erneut das Transkript: Ihre Anweisungen, die Tool-Definitionen, frühere Nachrichten, gelesene Dateien und Tool-Ergebnisse. Alles, was in dieses Transkript gelangt, wird bei späteren Schritten erneut gesendet oder verarbeitet und kann zur Nutzung gezählt werden, abhängig von Caching, Komprimierung und der Abrechnung des Anbieters. Der eigene Chat von ISMS Copilot funktioniert genauso, weshalb lange Threads mehr von Ihrem Nutzungsfenster pro Nachricht verbrauchen.
Die Frage ist also nicht nur, was eine einzelne Antwort kostet, sondern was danach im Transkript Ihres Agents verbleibt.
Was auf der Seite von ISMS Copilot bleibt
Wenn die Arbeit delegiert wird, bleiben die folgenden Elemente auf der Seite von ISMS Copilot, es sei denn, das zurückgegebene Ergebnis reproduziert sie. Die MCP-Anfrage, die Ihr Agent sendet, und das Ergebnis, das er zurückerhält (die Antwort sowie Felder wie IDs, Status, Nutzung und Fehler), gelangen jedoch in dessen Transkript, zusammen mit den Tool-Schemas, die weiter unten behandelt werden:
- Quellenmaterial der Frameworks. Die Standard- und Regulierungsreferenzen, auf denen ISMS Copilot seine Antworten basiert. Ihr Agent sendet die Frage, nicht den Framework-Text. Die Antwort kann die relevanten Teile zitieren oder referenzieren.
- Abruf. Das Auffinden der relevanten Klauseln, Kontrollen und Artikel für die Frage sowie der Kontext, der für das Modell zusammengestellt wird.
- Arbeitsbereichsspeicher und -dateien. Bei einem Schritt mit
workspace_idwerden sie auf der Seite von ISMS Copilot gelesen. Ihr Agent lädt sie nicht, auch wenn die Antwort Fakten daraus verwendet. - Zwischenschritte der Analyse. Die Analyse hinter der Antwort, einschließlich mehrstufiger Think- und Beyond-Arbeiten.
- Entwurfsdurchläufe. Längere Texte werden auf der Seite von ISMS Copilot generiert. Ihr Agent erhält das Ergebnis, nicht den Entwurfsprozess.
- Die Kopie des Threads beim Spezialisten. Folgeanfragen mit
send_messagesetzen einen Thread fort, den ISMS Copilot verwaltet, sodass Ihr Agent frühere Schritte dieses Threads nicht erneut in seiner Anfrage sendet. Die früheren Tool-Aufrufe und -Antworten bleiben dennoch im eigenen Transkript Ihres Agents, bis dieser sie bereinigt.
Wofür Ihr Agent weiterhin zahlt
Die Delegation macht den Compliance-Schritt für Ihren Orchestrator nicht kostenlos:
- Tool-Schemas. Die ISMS Copilot MCP-Tool-Definitionen befinden sich im Kontext Ihres Agents, sobald der Server verbunden ist, genau wie die Tools jedes anderen MCP-Servers.
- Die gesendete Frage. Alles, was Ihr Agent in
create_conversationodersend_messageschreibt, ist Teil seines Transkripts. - Die gelesene Antwort. Die zurückgegebenen Antworten sind Eingaben für das Modell Ihres Agents und bleiben für den Rest der Sitzung im Transkript.
Die Antwort ist der Teil, den Sie am meisten kontrollieren können. Übergeben Sie answer_format: "brief" (ca. 150 Wörter) oder "decision" (Empfehlung zuerst, ca. 300 Wörter), wenn Ihr Agent nur die Schlussfolgerung benötigt. Wenn das Ergebnis ein langes Dokument ist, lassen Sie Ihren Agent es in eine Datei schreiben, anstatt es im Chat zu wiederholen. Siehe GRC-Arbeiten von Ihrem Agent an ISMS Copilot delegieren.
Die Nutzungsquittung
Eine abgeschlossene Fast- oder Think-Antwort kann ein usage-Objekt enthalten:
{
"usage": {
"copilot_input_tokens": 0,
"copilot_output_tokens": 0
}
}Die oben genannten Werte sind Platzhalter. Die Felder sind:
copilot_input_tokensundcopilot_output_tokens: Tokens, die die Modelle von ISMS Copilot für diesen Schritt verarbeitet und erzeugt haben.copilot_cache_read_input_tokensundcopilot_cache_creation_input_tokens: nur enthalten, wenn der Modellanbieter sie meldet.
Diese Quittung zählt nur die Tokens auf der ISMS Copilot-Seite. Es handelt sich nicht um die Token-Zählung Ihres Agents und umfasst nicht das, was Ihr Orchestrator für die Frage, die Tool-Schemas oder das Lesen der Antwort ausgibt. Ihr Orchestrator meldet diese selbst. Das usage-Objekt wird weggelassen, wenn die Zahlen noch nicht verfügbar sind (get_reply enthält es, sobald sie erfasst wurden), und Beyond-Antworten enthalten es nicht.
Wo die Nutzung von ISMS Copilot abgerechnet wird
Es gibt kein separates MCP-Produkt oder eine separate Abrechnung. Delegierte Schritte werden gegen Ihren ISMS Copilot-Chat-Tarif verbucht:
- Das 4-Stunden-Nutzungsfenster. MCP-Schritte greifen auf dasselbe 4-Stunden-UTC-Sitzungsfenster wie die Chat-App zu, auf Ihrem eigenen Budget oder dem Pool Ihrer Organisation. Siehe Nutzungslimits verstehen.
- Overflow. Bei berechtigten kostenpflichtigen Einzelkonten (nicht Essential, Erweiterter Datenschutz deaktiviert) kann Ihr Agent nach Aufbrauch des Fensters nur mit Ihrer ausdrücklichen Zustimmung durch erneutes Senden mit
overflow_consent: truefortfahren. Der Schritt wird dann mit den offengelegten Fallback-Modellen ausgeführt, bis zum Zweifachen des Token-Limits des Tarifs zusätzlich. Overflow ist auf einem Team-Pool nie verfügbar. - Beyond-Läufe. Auf kostenpflichtigen Tarifen auf 10 pro UTC-Tag begrenzt, auf Unlimited auf 50.
Die eigene Modellnutzung Ihres Orchestrators wird wie gewohnt von Ihrem Orchestrator-Anbieter abgerechnet.
Gemessene Ergebnisse
Ein reproduzierbarer Benchmark für die Delegation ist in Arbeit. Wir veröffentlichen die Zahlen hier zusammen mit der Methode und dem Datum, an dem sie gemessen wurden, und nicht vorher.
Bis dahin beschreibt diese Seite nur den Mechanismus. Sie behauptet weder eine prozentuale Einsparung noch geringere Kosten als bei einem anderen Modell oder Abo noch eine bessere Antwortqualität als die des eigenen Modells Ihres Orchestrators.