Token Guardian MCP
Token Guardian MCP
Token Guardian es un servidor MCP local y de solo lectura para encontrar el desperdicio de tokens en Claude Code y Codex sin hacer que ninguno de los dos clientes sea más tonto.
Hace dos trabajos:
Informa qué agentes, modelos y sesiones están procesando la mayor cantidad de tokens.
Recomienda el modelo seguro más barato y el nivel de esfuerzo para una tarea específica.
También incluye un comando route-task de prueba en seco para probar el enrutamiento basado en el prompt antes de que el MCP esté registrado en algún lugar.
Límite de seguridad estricto
Token Guardian no puede cambiar la configuración del modelo, los niveles de esfuerzo, los límites de contexto, la compactación, el registro de MCP ni las sesiones en ejecución. No tiene credenciales de modelo y no realiza llamadas API de pago.
La herramienta de uso llama a ccusage con --offline y --no-cost. Los títulos de Codex son metadatos opcionales leídos a través de sqlite3 -readonly. Cada herramienta MCP está marcada como de solo lectura, no destructiva, idempotente y de mundo cerrado.
Related MCP server: token-pilot
Herramientas
token_guardian_usage_snapshot
Lee de uno a treinta días de uso local y devuelve:
Totales por agente y modelo
Proporciones de lectura de caché, salida y modelo frontera
Sesiones más grandes
Títulos de trabajo duplicados exactos de Codex
Victorias rápidas respaldadas por evidencia
Los tokens procesados son un diagnóstico de carga de trabajo. No son lo mismo que un medidor de suscripción, especialmente cuando la entrada en caché domina.
token_guardian_recommend_route
Acepta el cliente, la tarea, el riesgo y el tamaño de contexto actual. Devuelve un modelo, nivel de esfuerzo, razones y un validador frontera opcional.
La política falla de forma cerrada. El trabajo de seguridad, arquitectura, producción, destructivo, de alto riesgo, crítico o ambiguo permanece en un modelo frontera. Los modelos baratos manejan trabajo mecánico acotado. Los modelos equilibrados manejan codificación y depuración normales, con una revisión frontera cuando sea necesario.
Probar el enrutamiento basado en el prompt primero
Construye el proyecto, luego ejecuta el enrutador desde cualquier carpeta:
node ./dist/route-cli.js --client codex --prompt "Implement a bounded TypeScript parser with tests." --cwd .La carpeta de trabajo no necesita ser un repositorio. El enrutador usa principalmente el prompt. Verifica hasta 256 nombres en la carpeta actual en busca de marcadores de proyecto opcionales, sin abrir el contenido de los archivos ni escanear subcarpetas.
El comando solo imprime una recomendación y un comando de lanzamiento con ámbito de sesión. No ejecuta ese comando, no cambia la configuración, no registra el MCP ni toca una sesión activa. Los prompts de continuación vagos como "sí, prueba eso" permanecen en la ruta frontera porque su contexto real falta.
Requisitos locales
Node.js 24 o más reciente
ccusageen PATHsqlite3en PATH para títulos de hilos de Codex opcionales
Construir y probar
npm install
npm test
npm run typecheck
npm run buildEjecuta el servidor stdio construido:
node dist/index.jsInspecciónalo sin registrarlo en un cliente en vivo:
npx @modelcontextprotocol/inspector node dist/index.jsEstado del registro
Esta primera compilación no está registrada intencionalmente con Claude, Codex ni la puerta de enlace compartida de Kitsune. El registro y cualquier reinicio del cliente son un cambio separado después de que el servidor aislado sea aceptado.
Licencia
MIT. Ver LICENSE.
Maintenance
Resources
Unclaimed servers have limited discoverability.
Looking for Admin?
If you are the server author, to access and configure the admin panel.
Related MCP Servers
- AlicenseAqualityCmaintenanceAn MCP server that helps AI agents reduce token usage by compressing, summarizing, and managing conversation/context data more efficiently.11MIT
- AlicenseAqualityCmaintenanceMCP server that reduces token consumption in AI coding assistants by up to 90% via structural reads, PreToolUse hooks, and tp-\* subagents.254254MIT
- Alicense-qualityDmaintenanceMCP server that analyzes AI agent session logs to find token waste and optimization opportunities.17MIT
- Flicense-qualityDmaintenanceAn MCP server that reduces token usage by lazily loading skills and tools only when needed, and routing repetitive subtasks to ML backends instead of the LLM.
Related MCP Connectors
Hosted MCP server for LLM cost estimation, model comparison, and budget-aware routing.
Agent Cost Allocator MCP — multi-tenant LLM cost attribution for chargeback billing. Companion to
Agent Token Budget MCP — hard per-session token + spend cap with signed budget-exhausted
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/KitsuneTech1/token-guardian-mcp'
If you have feedback or need assistance with the MCP directory API, please join our Discord server