Token Guardian MCP
Token Guardian MCP
Token Guardian ist ein lokaler, schreibgeschützter MCP-Server, der Token-Verschwendung in Claude Code und Codex erkennt, ohne einen der beiden Clients dümmer zu machen.
Es erfüllt zwei Aufgaben:
Berichtet, welche Agents, Modelle und Sitzungen die meisten Token verarbeiten.
Empfiehlt das günstigste sichere Modell und den Aufwandsgrad für eine bestimmte Aufgabe.
Es enthält auch einen Trockenlauf-Befehl route-task zum Testen des Prompt-First-Routings, bevor der MCP irgendwo registriert wird.
Harte Sicherheitsgrenze
Token Guardian kann keine Modelleinstellungen, Aufwandsgrade, Kontextgrenzen, Kompaktierung, MCP-Registrierung oder laufende Sitzungen ändern. Es besitzt keine Modellanmeldedaten und tätigt keine kostenpflichtigen API-Aufrufe.
Das Nutzungstool ruft ccusage mit --offline und --no-cost auf. Codex-Titel sind optionale Metadaten, die über sqlite3 -readonly gelesen werden. Jedes MCP-Tool ist als schreibgeschützt, nicht destruktiv, idempotent und geschlossene Welt markiert.
Related MCP server: token-pilot
Werkzeuge
token_guardian_usage_snapshot
Liest ein bis dreißig Tage lokaler Nutzung und gibt zurück:
Gesamtsummen nach Agent und Modell
Cache-Lese-, Ausgabe- und Frontier-Modell-Anteile
Größte Sitzungen
Exakte doppelte Codex-Arbeitstitel
Evidenzgestützte schnelle Erfolge
Verarbeitete Token sind eine Arbeitslastdiagnose. Sie sind nicht dasselbe wie ein Abonnementzähler, insbesondere wenn zwischengespeicherte Eingaben dominieren.
token_guardian_recommend_route
Akzeptiert den Client, die Aufgabe, das Risiko und die aktuelle Kontextgröße. Es gibt ein Modell, einen Aufwandsgrad, Gründe und einen optionalen Frontier-Validator zurück.
Die Richtlinie schließt fehl. Sicherheits-, Architektur-, Produktions-, destruktive, risikoreiche, kritische oder mehrdeutige Arbeiten bleiben auf einem Frontier-Modell. Günstige Modelle übernehmen begrenzte mechanische Arbeiten. Ausgewogene Modelle übernehmen normales Codieren und Debuggen, bei Bedarf mit einer Frontier-Überprüfung.
Prompt-First-Routing testen
Erstellen Sie das Projekt und führen Sie dann den Router von einem beliebigen Ordner aus:
node ./dist/route-cli.js --client codex --prompt "Implement a bounded TypeScript parser with tests." --cwd .Der Arbeitsordner muss kein Repository sein. Der Router verwendet hauptsächlich den Prompt. Er überprüft bis zu 256 Namen im aktuellen Ordner auf optionale Projektmarkierungen, ohne Dateiinhalte zu öffnen oder Unterordner zu durchsuchen.
Der Befehl gibt nur eine Empfehlung und einen sitzungsbezogenen Startbefehl aus. Er führt diesen Befehl nicht aus, ändert keine Konfiguration, registriert den MCP nicht und berührt keine aktive Sitzung. Vage Fortsetzungsaufforderungen wie yeah, test that bleiben auf der Frontier-Route, da ihr tatsächlicher Kontext fehlt.
Lokale Anforderungen
Node.js 24 oder neuer
ccusageim PATHsqlite3im PATH für optionale Codex-Thread-Titel
Erstellen und testen
npm install
npm test
npm run typecheck
npm run buildFühren Sie den erstellten Stdio-Server aus:
node dist/index.jsÜberprüfen Sie ihn, ohne ihn in einem Live-Client zu registrieren:
npx @modelcontextprotocol/inspector node dist/index.jsRegistrierungsstatus
Dieser erste Build ist absichtlich nicht bei Claude, Codex oder dem gemeinsamen Kitsune-Gateway registriert. Die Registrierung und ein etwaiger Client-Neustart sind eine separate Änderung, nachdem der isolierte Server akzeptiert wurde.
Lizenz
MIT. Siehe LICENSE.
Maintenance
Resources
Unclaimed servers have limited discoverability.
Looking for Admin?
If you are the server author, to access and configure the admin panel.
Related MCP Servers
- AlicenseAqualityCmaintenanceAn MCP server that helps AI agents reduce token usage by compressing, summarizing, and managing conversation/context data more efficiently.11MIT
- AlicenseAqualityCmaintenanceMCP server that reduces token consumption in AI coding assistants by up to 90% via structural reads, PreToolUse hooks, and tp-\* subagents.254254MIT
- Alicense-qualityDmaintenanceMCP server that analyzes AI agent session logs to find token waste and optimization opportunities.17MIT
- Flicense-qualityDmaintenanceAn MCP server that reduces token usage by lazily loading skills and tools only when needed, and routing repetitive subtasks to ML backends instead of the LLM.
Related MCP Connectors
Hosted MCP server for LLM cost estimation, model comparison, and budget-aware routing.
Agent Cost Allocator MCP — multi-tenant LLM cost attribution for chargeback billing. Companion to
Agent Token Budget MCP — hard per-session token + spend cap with signed budget-exhausted
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/KitsuneTech1/token-guardian-mcp'
If you have feedback or need assistance with the MCP directory API, please join our Discord server