Ce que la délégation économise (et ce qu'elle n'économise pas)
Comment la délégation des tâches GRC à ISMS Copilot via MCP maintient le contexte hors de la transcription de votre agent, ce pour quoi votre agent paie toujours, ce que le reçu d'utilisation indique, et où l'utilisation d'ISMS Copilot est facturée.
Lorsque votre orchestrateur délègue une question de conformité à ISMS Copilot, une partie du travail est effectuée côté ISMS Copilot plutôt que dans le contexte de votre agent. Cette page explique le mécanisme, ce qui ne change pas, et comment les deux côtés sont facturés. Elle ne prétend pas indiquer combien vous économisez : cela dépend de votre orchestrateur, de votre modèle et de votre travail.
Pourquoi le contexte de votre agent est important
Un agent basé sur le chat ne conserve pas les échanges précédents par lui-même. À chaque tour, un orchestrateur typique renvoie au modèle sa transcription : vos instructions, les définitions des outils, les messages précédents, les fichiers lus et les résultats des outils. Tout ce qui entre dans cette transcription est renvoyé ou retraité lors des tours suivants et peut être comptabilisé dans l'utilisation, sous réserve de la mise en cache, de la compaction et de la comptabilité du fournisseur. Le chat d'ISMS Copilot fonctionne de la même manière, c'est pourquoi les longs fils de discussion utilisent davantage votre fenêtre d'utilisation par message.
La question n'est donc pas seulement de savoir ce qu'une seule réponse coûte, mais aussi ce qui reste dans la transcription de votre agent par la suite.
Ce qui reste côté ISMS Copilot
Lorsque le travail est délégué, les éléments ci-dessous restent côté ISMS Copilot, sauf si le résultat retourné les reproduit. La requête MCP que votre agent envoie et le résultat qu'il reçoit (la réponse ainsi que des champs tels que les ID, le statut, l'utilisation et les erreurs) entrent dans sa transcription, aux côtés des schémas d'outils abordés plus loin :
- Matériel source des cadres de référence : les références aux normes et réglementations sur lesquelles ISMS Copilot base ses réponses. Votre agent envoie la question, pas le texte du cadre de référence. La réponse peut citer ou référencer les parties pertinentes.
- Récupération : recherche des clauses, contrôles et articles pertinents pour la question, ainsi que du contexte assemblé pour le modèle.
- Mémoires et fichiers de l'espace de travail : dans un tour avec un
workspace_id, ils sont lus côté ISMS Copilot. Votre agent ne les charge pas, bien que la réponse puisse utiliser des faits qui en proviennent. - Raisonnement intermédiaire : l'analyse derrière la réponse, y compris le travail multi-étapes des modes Think et Beyond.
- Passes de rédaction : les textes longs sont générés côté ISMS Copilot. Votre agent reçoit le résultat, pas le processus de rédaction.
- Copie de la discussion par le spécialiste : les suites avec
send_messagecontinuent une discussion qu'ISMS Copilot conserve. Votre agent ne renvoie donc pas les tours précédents de cette discussion dans sa requête. Les appels d'outils et les réponses précédents restent dans la transcription de votre agent jusqu'à ce qu'il les supprime.
Ce pour quoi votre agent paie toujours
La délégation ne rend pas l'étape de conformité gratuite pour votre orchestrateur :
- Schéma des outils : les définitions des outils MCP d'ISMS Copilot se trouvent dans le contexte de votre agent une fois le serveur connecté, comme pour tout autre serveur MCP.
- La question qu'il envoie : tout ce que votre agent écrit dans
create_conversationousend_messagefait partie de sa transcription. - La réponse qu'il lit : la réponse retournée est une entrée pour le modèle de votre agent, et elle reste dans la transcription pour le reste de la session.
La réponse est la partie que vous contrôlez le plus. Utilisez answer_format: "brief" (environ 150 mots) ou "decision" (recommandation en premier, environ 300 mots) lorsque votre agent n'a besoin que de la conclusion. Lorsque le livrable est un long document, demandez à votre agent de l'écrire dans un fichier plutôt que de le répéter dans le chat. Voir Déléguer les tâches GRC depuis votre agent.
Le reçu d'utilisation
Une réponse Fast ou Think terminée peut inclure un objet usage :
{
"usage": {
"copilot_input_tokens": 0,
"copilot_output_tokens": 0
}
}Les valeurs ci-dessus sont des espaces réservés. Les champs sont les suivants :
copilot_input_tokensetcopilot_output_tokens: jetons traités et produits par les modèles d'ISMS Copilot pour ce tour.copilot_cache_read_input_tokensetcopilot_cache_creation_input_tokens: inclus uniquement lorsque le fournisseur de modèle les signale.
Ce reçu compte uniquement les jetons côté ISMS Copilot. Il ne s'agit pas du nombre de jetons de votre agent et n'inclut pas ce que votre orchestrateur dépense pour la question, les schémas d'outils ou la lecture de la réponse. Votre orchestrateur signale ces éléments lui-même. L'objet usage est omis lorsque les chiffres ne sont pas encore disponibles (get_reply l'inclut une fois qu'ils sont enregistrés), et les réponses Beyond ne l'incluent pas.
Où l'utilisation d'ISMS Copilot est facturée
Il n'y a pas de produit ou de compteur MCP séparé. Les tours délégués sont comptabilisés dans votre forfait chat ISMS Copilot :
- Fenêtre d'utilisation de 4 heures : les tours MCP puisent dans la même session UTC de 4 heures que l'application de chat, sur votre propre budget ou celui de votre organisation. Voir Comprendre les limites d'utilisation.
- Dépassement : sur les comptes solo payants éligibles (hors Essential, avec la Protection avancée des données désactivée), lorsque la fenêtre est épuisée, votre agent ne peut continuer que sur votre accord explicite en renvoyant la requête avec
overflow_consent: true. Le tour s'exécute alors sur les modèles de repli divulgués, jusqu'à une limite supplémentaire de 2 fois la limite de jetons du forfait. Le dépassement n'est jamais disponible sur un pool d'équipe. - Exécutions Beyond : limitées à 10 par jour UTC pour les forfaits payants, 50 pour Unlimited.
L'utilisation du modèle de votre orchestrateur est facturée par votre fournisseur d'orchestrateur, comme d'habitude.
Résultats mesurés
Un benchmark reproductible de la délégation est en cours. Nous publierons les chiffres ici avec la méthode et la date à laquelle ils ont été mesurés, et pas avant.
En attendant, cette page décrit uniquement le mécanisme. Elle ne prétend pas à un pourcentage d'économie, à un coût inférieur à celui de tout autre modèle ou abonnement, ni à une meilleure qualité de réponse que le modèle de votre orchestrateur.