---
title: "MCP-Tokenverbrauch und Kontext-Ballast senken — onemcp"
description: "MCP-Server senden bei jeder Anfrage Hunderte Definitionen erneut. onemcps Code Mode ersetzt sie durch drei Meta-Tools — rund 90 % weniger Overhead pro Aufruf."
url: "https://onemcp.dev/de/use-cases/reduce-token-usage/"
---

# Lass MCP-Tool-Definitionen nicht deinen Kontext auffressen.

Jeder MCP-Server flutet den Prompt bei jeder Anfrage mit seinem vollen Tool-Schema. onemcp zeigt nur drei Meta-Tools und lässt das Modell den Rest scripten — so geht das Kontextfenster an dein Problem, nicht an Boilerplate.

## Wie onemcp den Overhead schrumpft

1. **Hinter einem Portal bündeln** — onemcp verbindet sich mit all deinen Servern und fasst ihre Tools mit Namespaces auf einem Endpunkt zusammen.
2. **Drei Meta-Tools zeigen** — search, describe und execute ersetzen jede vorab geladene Tool-Definition.
3. **Das Modell Code schreiben lassen** — Cloudflare Code Mode führt ein Skript aus, das nur die wirklich nötigen Tools aufruft.

## Was du zurückbekommst

- **~90 % kleinerer System-Prompt** — Der Tool-Overhead sinkt von rund 15.000 auf etwa 500 Token pro Anfrage.
- **Weniger Kosten und Latenz** — Weniger Eingabe-Token bedeuten günstigere, schnellere Turns — bei jedem Aufruf.
- **Tools bei Bedarf** — Signaturen werden nur bei Bedarf geholt, nicht vorab hineingestopft.

## Gib das Kontextfenster deinem Agenten zurück.

Stell deine Server hinter ein Portal und lass Code Mode den Rest erledigen.
