Definições de ferramentas são enviadas em toda requisição, não uma única vez. Cole a URL do seu servidor MCP e veja quantos tokens são, quais ferramentas pesam mais e quanto custa.
Reduzir o custo de contexto barateia a operação do seu servidor, mas continua não mostrando a um cliente o que ele faz. Aponte o MCP Showcase para a mesma URL e tenha um playground ao vivo com documentação por ferramenta.
Lemos as definições de ferramentas que o servidor anuncia — as mesmas que um agente recebe.
Nome, descrição e o esquema JSON de entrada completo, porque os três são enviados ao modelo a cada turno.
Total de tokens por requisição, custo estimado por 1.000 turnos e as ferramentas ordenadas pelo contexto que cada uma consome.
Esta é a parte que surpreende. As definições de ferramentas de um servidor MCP não são carregadas uma única vez no início da conversa: o modelo não se lembra delas entre os turnos, então a lista completa, com todas as descrições e todos os esquemas JSON de entrada, é enviada de novo em cada requisição. Quarenta ferramentas prolixas não são um custo pontual; são um imposto fixo sobre cada turno de cada conversa que o seu agente vier a ter.
Cole acima a URL de um servidor MCP e esta calculadora lê exatamente o que um agente recebe, mede tudo e mostra onde o peso realmente está.
Em ordem de retorno. Remova ferramentas que ninguém chama. Servidores as acumulam, e cada uma é cobrada em todo turno, sendo útil ou não. Encurte as descrições para uma frase clara sobre o que a ferramenta faz e quando usá-la: o que passa disso costuma ter sido escrito para um leitor humano que nunca vai vê-lo. Enxugue os esquemas de entrada: descrições longas por propriedade e objetos opcionais muito aninhados são normalmente o grosso de uma ferramenta pesada, e se acumulam porque esquema é JSON verboso, não prosa.
Há um segundo motivo que nada tem a ver com dinheiro: a precisão na escolha da ferramenta cai conforme a lista cresce. Um modelo escolhendo entre oitenta ferramentas descritas de forma parecida erra muito mais do que um escolhendo entre oito — então enxugar a lista costuma deixar o agente melhor, não apenas mais barato.
A contagem aproxima cerca de 3,6 caracteres por token, o que combina com o texto denso em JSON das definições e normalmente fica dentro de 10–15% de um tokenizador real. É a ferramenta certa para comparar ferramentas entre si e encontrar excesso. Não é a ferramenta certa para conferir uma fatura, e a página diz isso em cada resultado em vez de deixar você supor o contrário.
Cortar descrições para economizar contexto barateia o seu servidor e deixa o agente mais certeiro. Também torna o servidor mais difícil de entender para uma pessoa, e isso vira problema no momento em que alguém precisa avaliá-lo. O MCP Showcase resolve esse impasse: o modelo recebe os seus esquemas enxutos, enquanto clientes em potencial recebem um playground ao vivo com documentação gerada e legível para cada ferramenta. Assim você não escreve uma única descrição que precise servir a dois leitores muito diferentes.