LeanRigor MCP Server
LeanRigor
Menos contexto. Rigor total de ingeniería.
Un harness de ingeniería local-first y multi-agente. LeanRigor elimina el contexto innecesario de las sesiones de agentes de codificación, preservando al mismo tiempo las puertas de diseño, prueba, seguridad y verificación que el nivel de riesgo de la tarea realmente requiere.
npx leanrigor initEl contrato
Esta es la parte que hay que leer antes de los números.
Las puertas de ingeniería requeridas nunca se eliminan para ahorrar tokens. La verificación es obligatoria en todos los niveles de riesgo; una tarea crítica no puede omitir su modelo de amenazas, aprobación o plan de reversión por ningún motivo, incluido un presupuesto de tokens.
Los ahorros solo cuentan para el trabajo que pasó. Una reducción lograda al producir una respuesta incorrecta no es una reducción y se excluye de todo total.
Cada número indica su modo de medición y cobertura. Una estimación local nunca se denomina uso del proveedor, y dos modos de medición nunca se suman en un total sin etiqueta.
Nada se destruye. Cada proyección lleva un identificador que restaura los bytes originales, o está marcada explícitamente como solo resumen.
La telemetría está desactivada por defecto, y
leanrigor telemetry inspectimprime la carga útil exacta antes de que decidas.Las cifras de energía son rangos estimados versionados, nunca mediciones de centro de datos. Consulta docs/environmental-methodology.md.
Related MCP server: AI Knowledge Center MCP
Resultado medido
Del corpus determinista en evals/, reproducible con un solo comando:
npx leanrigor benchmarkMétrica | Valor | Casos | Medición |
Reducción mediana de contexto | 93.3% | 8 aprobados | byte-only |
Delta de tasa de aprobación vs línea base | 0.0 puntos | 8 | deterministic verifier |
Tasa de finalización | 100% | 8 | — |
Las cifras por caso, el resultado bruto y el veredicto de la puerta de liberación están en docs/benchmarks/. Cada porcentaje allí indica el número de casos y el modo de medición que lo respalda.
Lo que esto no afirma. Estos casos miden lo que las propias transformaciones de LeanRigor hacen a una carga útil — no interviene ningún modelo.
Evaluación de habilidades
Las habilidades ahora se han evaluado con un modelo real (Codex CLI, gpt-5.5), línea base versus con habilidad, con comprobaciones deterministas:
Habilidad | Línea base | Con habilidad | Mejora | Repeticiones |
senior-system-design | 2/6 | 6/6 | +66.7 puntos | 1 |
product-brainstorming | 0/5 | 4/5 | +80.0 puntos | 1 |
verification | 16/20 | 18/20 | +10.0 puntos | 4 |
Las tres descripciones de activación están acotadas: el router no seleccionó ninguna de ellas en ninguno de los nueve prompts no activadores.
No cites esos números sin la advertencia. Ejecutar la suite verification tres veces con una configuración sin cambios produjo +40, +20 y −20 puntos. Una oscilación de 60 puntos significa que cualquier valor por debajo de aproximadamente veinte puntos con n=1 es ruido, y los dos resultados grandes anteriores son ejecuciones individuales. El informe completo, incluidos los cinco defectos encontrados en el propio harness de evaluación y los dos encontrados en las habilidades, está en docs/benchmarks/skill-eval.md.
Qué hace
Componente | Función |
MCP gateway | Expone 4 herramientas a tu host en lugar de 200. Las herramientas se buscan, no se transmiten; los resultados grandes se almacenan localmente y se devuelven como una proyección compacta respaldada por un identificador. |
TokenLeaf Engine | Mide lo que realmente se ahorró, por modo de medición, y se niega a contar ahorros de trabajo fallido. |
Rigor Gates | Clasifica el riesgo de la tarea de forma determinista — sin llamada a modelo — y selecciona el conjunto más pequeño suficiente de puertas de ingeniería. |
Verified Skills | Tres habilidades portátiles para agente con licencias, registros de procedencia, presupuestos de contexto y suites de evaluación. |
Hosts compatibles
Host | Estado |
Claude Code | compatible |
Codex | compatible |
Gemini CLI | aún no; adaptador planeado |
leanrigor init detecta lo que está instalado, previsualiza cada cambio de archivo, hace una copia de seguridad de todo lo que modifica y nunca escribe antes de que confirmes.
Comandos
npx leanrigor init # install, with a preview and confirmation
npx leanrigor init --dry-run # show the plan, write nothing
npx leanrigor init --uninstall # restore the original files
npx leanrigor doctor # diagnose the installation
npx leanrigor mcp serve # run the gateway (hosts launch this)
npx leanrigor benchmark # run the reproducible benchmark
npx leanrigor report # local session report
npx leanrigor report --share # local SVG card, aggregate counts only
npx leanrigor skills list
npx leanrigor skills install verification
npx leanrigor telemetry statusValores predeterminados de privacidad
Sin cuenta. Sin llamada de red propia hasta que actives la telemetría. Los prompts, el código fuente, las rutas de archivo, los nombres de repositorio y las cargas útiles de herramientas nunca se envían a ningún lugar, en ninguna configuración: los esquemas del libro mayor y de la telemetría no tienen ningún campo que pueda transportarlos. Consulta docs/privacy.md.
Desinstalación
npx leanrigor init --uninstallLos archivos se restauran a sus bytes originales. Lo único que queda es un registro de auditoría de solo adición bajo .leanrigor/.
Limitaciones actuales
Expresadas claramente, porque un harness que se sobreestima es peor que ninguno:
Dos de los tres resultados de mejora de habilidades son n=1, y la varianza de ejecución a ejecución en esta suite ha alcanzado los 60 puntos. Vuelve a ejecutar con
--repeatantes de confiar en ellos.Cuatro de los cinco casos de
verificationno discriminan — la línea base los pasa siempre, por lo que no miden nada. Esa suite necesita casos más difíciles.No se ha realizado ablación. Ninguna sección de ninguna habilidad ha demostrado aún que merezca el contexto que cuesta.
Cada número de habilidad proviene de un único CLI y un único modelo.
Las condiciones de
gateway+workflowygateway+workflow+skilldel benchmark aún no están implementadas; hoy solo se ejecutanbaselineygateway.La clasificación de riesgo se basa en expresiones regulares y rutas. Es deliberadamente conservadora y sobreclasificará antes que subclasificar, pero no es inteligente.
El adaptador de Codex reescribe
config.toml, lo que elimina los comentarios de TOML. El plan de instalación advierte sobre esto y el original se respalda.Aún no hay adaptador para Gemini CLI.
El paquete publicado incluye los espacios de trabajo internos
@leanrigor/*; esas API no son estables y no se publican por separado.
Documentación
Límites de medición — qué se mide, estima y es incognoscible
Contribuciones
Las superficies de extensión acotadas y propias se documentan en docs/extensions/: proyectores, adaptadores de host y paquetes de habilidades. Cada una tiene un contrato de aceptación, por lo que una contribución puede juzgarse frente a un estándar establecido en lugar del estado de ánimo de un mantenedor.
Licencia
Apache-2.0. Los avisos de terceros y el libro de reutilización están en THIRD_PARTY_NOTICES.md. No se ha copiado ninguna fuente ni prosa de terceros en este repositorio.
This server cannot be installed
Maintenance
Resources
Unclaimed servers have limited discoverability.
Looking for Admin?
If you are the server author, to access and configure the admin panel.
Related MCP Servers
- AlicenseAqualityAmaintenanceA local-first redacting MCP gateway that strips secrets from file reads and shell output before they reach an AI coding agent's context, the command still runs with the real credential, but the model never sees it.218MIT
- Alicense-qualityAmaintenanceLocal-first MCP server that provides project context, verification gates, and structured tools for coding agents to discover knowledge, run diagnostics, and execute allowlisted commands within a repository.43MIT
- Alicense-qualityBmaintenanceA gateway that enforces permissions, sanitization, approval, and audit for AI agent MCP tool calls, with a policy engine and local proxy CLI.3101MIT
- Alicense-qualityAmaintenanceA zero-trust security gateway for MCP tool calls, inspecting tool identity, arguments, execution decisions, and returned content before risk reaches your coding agent.Apache 2.0
Related MCP Connectors
Private-by-default, local-first memory/context/task orchestrator for MCP apps and agents.
Remote MCP for Copilot CLI switch gate MCP, structured receipts, audit logs, and reviewer-ready evid
Zero-install security baseline for AI coding agents — OWASP/CWE-cited rules over MCP.
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/badrabbitt/leanrigor'
If you have feedback or need assistance with the MCP directory API, please join our Discord server