Les définitions d'outils sont envoyées à chaque requête, pas une seule fois. Collez l'URL de votre serveur MCP pour voir combien de tokens cela représente, quels outils pèsent le plus et ce que cela coûte.
Réduire le coût de contexte rend votre serveur moins cher à exploiter. Cela ne montre toujours pas à un client ce qu'il fait. Pointez MCP Showcase sur la même URL pour un playground en direct avec une documentation par outil.
Nous lisons les définitions d'outils annoncées par le serveur — exactement celles que reçoit un agent.
Nom, description et schéma JSON d'entrée complet, car les trois sont envoyés au modèle à chaque tour.
Total de tokens par requête, coût estimé pour 1 000 tours, et les outils classés selon le contexte que chacun consomme.
C'est la partie qui surprend. Les définitions d'outils d'un serveur MCP ne sont pas chargées une fois au début d'une conversation : le modèle ne s'en souvient pas d'un tour à l'autre, si bien que la liste complète, avec toutes les descriptions et tous les schémas JSON d'entrée, est renvoyée à chaque requête. Quarante outils bavards ne sont pas un coût ponctuel ; c'est une taxe fixe sur chaque tour de chaque conversation que votre agent aura un jour.
Collez ci-dessus l'URL d'un serveur MCP : ce calculateur lit exactement ce que reçoit un agent, le mesure, et montre où se trouve réellement le poids.
Par ordre d'efficacité. Supprimez les outils que personne n'appelle. Les serveurs les accumulent, et chacun est facturé à chaque tour, utile ou non. Raccourcissez les descriptions à une phrase claire indiquant ce que fait l'outil et quand l'utiliser : au delà, c'est généralement écrit pour un lecteur humain qui ne le verra jamais. Allégez les schémas d'entrée : les longues descriptions par propriété et les objets optionnels profondément imbriqués constituent le gros d'un outil lourd, et ils s'accumulent parce qu'un schéma est du JSON verbeux, pas de la prose.
Il y a une seconde raison, sans rapport avec l'argent : la justesse de la sélection d'outil baisse à mesure que la liste s'allonge. Un modèle qui choisit parmi quatre-vingts outils décrits de façon similaire se trompe bien plus souvent qu'un modèle qui choisit parmi huit — alléger la liste rend donc généralement l'agent meilleur, pas seulement moins cher.
Le calcul approxime environ 3,6 caractères par token, ce qui convient au texte très dense en JSON des définitions d'outils, et tombe généralement à 10–15 % près d'un vrai tokenizer. C'est l'outil adapté pour comparer des outils entre eux et repérer le superflu. Ce n'est pas l'outil adapté pour vérifier une facture, et la page le dit sur chaque résultat plutôt que de vous laisser le supposer.
Raccourcir les descriptions pour économiser du contexte rend votre serveur moins cher et votre agent plus précis. Cela le rend aussi plus difficile à comprendre pour un humain, ce qui devient un problème dès que quelqu'un doit l'évaluer. MCP Showcase règle cette tension : le modèle reçoit vos schémas allégés, tandis que vos prospects obtiennent un playground en direct avec une documentation générée et lisible pour chaque outil. Vous n'écrivez donc pas une description unique censée satisfaire deux lecteurs très différents.