O que a delegação economiza (e o que não economiza)
Como delegar o trabalho de GRC ao ISMS Copilot por meio do MCP mantém o contexto fora do histórico do seu agente, o que o seu agente ainda paga, o que o recibo de uso exibe e onde o uso do ISMS Copilot é cobrado.
Quando o seu agente de codificação delega uma pergunta de conformidade ao ISMS Copilot, parte do trabalho é realizada no lado do ISMS Copilot, em vez de no contexto do seu agente. Esta página explica o mecanismo, o que não é alterado e como as duas partes são cobradas. Não afirma quanto você economiza: isso depende do seu orquestrador, do seu modelo e do seu trabalho.
Por que o contexto do seu agente é importante
Um agente baseado em chat não retém as interações anteriores por conta própria. Em cada interação, um orquestrador típico envia o histórico novamente para o modelo: suas instruções, as definições das ferramentas, mensagens anteriores, arquivos lidos e resultados das ferramentas. Qualquer coisa que entre nesse histórico é enviada ou processada novamente em interações posteriores e pode contar para o uso, sujeito a cache, compactação e contabilização do provedor. O próprio chat do ISMS Copilot funciona da mesma forma, por isso tópicos longos usam mais da sua janela de uso por mensagem.
Portanto, a pergunta não é apenas o custo de uma única resposta, mas o que permanece no histórico do seu agente depois.
O que permanece no lado do ISMS Copilot
Quando o trabalho é delegado, os itens a seguir permanecem no lado do ISMS Copilot, a menos que o resultado retornado os reproduza. A solicitação MCP que o seu agente envia e o resultado que recebe (a resposta, além de campos como IDs, status, uso e erros) entram no histórico, junto com os esquemas das ferramentas abordados mais adiante:
- Material de origem do framework. As referências de padrões e regulamentos em que o ISMS Copilot baseia suas respostas. O seu agente envia a pergunta, não o texto do framework. A resposta pode citar ou referenciar as partes relevantes.
- Recuperação. Localização das cláusulas, controles e artigos relevantes para a pergunta e do contexto montado para o modelo.
- Memórias e arquivos do workspace. Em uma interação com escopo
workspace_id, eles são lidos no lado do ISMS Copilot. O seu agente não os carrega, embora a resposta possa usar fatos deles. - Raciocínio intermediário. A análise por trás da resposta, incluindo o trabalho em várias etapas dos modos Think e Beyond.
- Passes de redação. Textos longos são gerados no lado do ISMS Copilot. O seu agente recebe o resultado, não o processo de redação.
- Cópia do tópico do especialista. Seguimentos com
send_messagecontinuam um tópico que o ISMS Copilot mantém, para que o seu agente não precise reenviar interações anteriores daquele tópico na solicitação. As chamadas de ferramentas e respostas anteriores ainda permanecem no histórico do seu agente até que ele as remova.
O que o seu agente ainda paga
A delegação não torna a etapa de conformidade gratuita para o seu orquestrador:
- Esquemas das ferramentas. As definições das ferramentas MCP do ISMS Copilot ficam no contexto do seu agente assim que o servidor é conectado, como as ferramentas de qualquer outro servidor MCP.
- A pergunta que envia. O que o seu agente escreve em
create_conversationousend_messagefaz parte do histórico. - A resposta que lê. A resposta retornada é entrada para o modelo do seu agente e permanece no histórico pelo resto da sessão.
A resposta é a parte que você controla mais. Use answer_format: "brief" (cerca de 150 palavras) ou "decision" (recomendação primeiro, cerca de 300 palavras) quando o seu agente precisar apenas da conclusão. Quando o entregável é um documento longo, peça ao seu agente para gravá-lo em um arquivo, em vez de repeti-lo no chat. Veja Delegar trabalho de GRC do seu agente.
O recibo de uso
Uma resposta concluída nos modos Fast ou Think pode conter um objeto usage:
{
"usage": {
"copilot_input_tokens": 0,
"copilot_output_tokens": 0
}
}Os valores acima são espaços reservados. Os campos são:
copilot_input_tokensecopilot_output_tokens: tokens processados e produzidos pelos modelos do ISMS Copilot naquela interação.copilot_cache_read_input_tokensecopilot_cache_creation_input_tokens: incluídos apenas quando o provedor do modelo os relata.
Esse recibo conta apenas os tokens do lado do ISMS Copilot. Não é a contagem de tokens do seu agente e não inclui o que o seu orquestrador gasta com a pergunta, os esquemas das ferramentas ou a leitura da resposta; o seu orquestrador relata isso por conta própria. O objeto usage é omitido quando os números ainda não estão disponíveis (get_reply o inclui assim que são registrados), e as respostas Beyond não o contêm.
Onde o uso do ISMS Copilot é cobrado
Não há um produto ou medidor MCP separado. As interações delegadas são contabilizadas no plano de chat do ISMS Copilot:
- A janela de uso de 4 horas. As interações MCP consomem a mesma janela de sessão de 4 horas UTC do aplicativo de chat, no seu orçamento próprio ou no pool da sua organização. Veja Compreendendo os limites de uso.
- Overflow. Em contas individuais pagas elegíveis (não Essential, com a Proteção Avançada de Dados desativada), quando a janela é esgotada, o seu agente só pode continuar com a sua autorização explícita, reenviando com
overflow_consent: true. A interação é executada nos modelos de fallback divulgados, até um limite adicional de 2x o limite de tokens do plano. O Overflow nunca está disponível em um pool de equipe. - Execuções Beyond. Limitadas a 10 por dia UTC em planos pagos, 50 no Unlimited.
O uso do modelo do seu orquestrador é cobrado pelo provedor do seu orquestrador, como de costume.
Resultados medidos
Um benchmark reprodutível de delegação está em andamento. Publicaremos os números aqui com o método e a data em que foram medidos, e não antes.
Até lá, esta página descreve apenas o mecanismo. Não afirma uma economia percentual, um custo menor do que qualquer outro modelo ou assinatura, nem uma qualidade de resposta melhor do que o modelo do seu próprio orquestrador.