LocalForge
LocalForge ⚒️
Puente del Model Context Protocol (MCP) para codificación agéntica híbrida — en el que se delega la implementación con alto consumo de tokens a modelos locales de código abierto.
Arquitectura en la nube. Implementación en local. Ahorra entre un 80 y un 90 % de tokens premium de API.
💡 El problema y la solución
En las configuraciones tradicionales de codificación agéntica, los modelos de frontera (OpenAI Codex, Claude 3.7 Sonnet / Opus) ejecutan cada paso del flujo de trabajo: desde el razonamiento de alto nivel hasta leer miles de líneas del repositorio, ejecutar suites de pruebas y corregir errores del compilador.
Esto es extremadamente caro e ineficiente:
Se consume más del 80 % del total de tokens en bucles repetitivos y mecánicos (descubrimiento de archivos, correcciones de sintaxis, iteraciones de pruebas unitarias).
El contexto propietario del código se transmite repetidamente a APIs externas en la nube.
LocalForge resuelve esto con Codificación Agéntica Híbrida:
Modelo de frontera (Nube): Actúa como arquitecto y revisor (alta inteligencia, bajo volumen de tokens).
LocalForge (límite MCP): envía especificaciones de tareas estructuradas y acotadas y gestiona los entornos locales de prueba.
Modelo local de código abierto (LLM local): ejecuta localmente los bucles de implementación, edición y depuración de pruebas con alto consumo de tokens, con un coste marginal de API de cero.
Revisión de la frontera: el modelo en la nube inspecciona únicamente el diff conciso, los registros y el resumen para verificar su correcto funcionamiento.
┌──────────────────────────────────────────────────────────┐
│ 1. ARCHITECT / REVIEWER │
│ (Codex / Claude) │
│ • Understands requirement • Reviews diff & logs │
└────────────────────────────┬─────────────────────────────┘
│
[MCP Task Specification]
│
▼
┌──────────────────────────────────────────────────────────┐
│ 2. LOCALFORGE (MCP) │
│ • Session continuity • Privacy boundary │
│ • Cross-process locks • Telemetry ledger │
└────────────────────────────┬─────────────────────────────┘
│
[Local Inference Stream]
│
▼
┌──────────────────────────────────────────────────────────┐
│ 3. IMPLEMENTATION WORKER │
│ (DeepSeek V4 Flash / Qwen 2.5 / 3.5) │
│ ┌────────────────────────────────────────────────────┐ │
│ │ 🔄 LOCAL ITERATION LOOP │ │
│ │ Read Repo ➔ Edit Code ➔ Run Tests ➔ Fix Errors │ │
│ └────────────────────────────────────────────────────┘ │
└──────────────────────────────────────────────────────────┘Related MCP server: local-llm-delegation-mcp
✨ Características clave
📉 Reducción de tokens premium del 80-90%: las ediciones de código, la indexación de archivos y la depuración de pruebas que más tokens consumen permanecen íntegramente en el hardware local.
🛡️ Privacidad y límites de seguridad estrictos: los archivos internos sensibles y los volcados de diagnóstico de varias rondas permanecen dentro de tu red local.
🔄 Continuidad de sesión: los seguimientos en varias veces (
opencode_followup) retoman la misma sesión de ejecución sin reenviar el contexto completo del repositorio.🔒 Bloqueo del repositorio entre procesos: evita escrituras concurrentes conflictivas en varias pestañas o clientes de agente.
📊 Telemetría y libro de auditoría: registro automático de la duración de la ejecución, archivos modificados, líneas añadidas/eliminadas y ahorro de tokens estimado en
state/ledger.jsonl.⚡ Registro de clientes sin configuración: un único comando de instalación para Codex, Claude Code, Claude Desktop y Antigravity.
🛠️ Referencia de las herramientas MCP
LocalForge registra 8 herramientas nativas sobre el protocolo estándar Model Context Protocol (stdio/JSON-RPC):
Herramienta | Descripción |
| Envía una especificación de tarea acotada (objetivo, restricciones, interfaces, contexto) al trabajador local. |
| Espera única de bloqueo hasta que una tarea en ejecución alcance el estado terminal ( |
| Instantánea de estado no bloqueante de una tarea activa o terminada. |
| Devuelve un diff de git acotado de los cambios realizados por el trabajador local respecto al commit de referencia. |
| Reactiva una sesión de OpenCode existente para corregir defectos, ajustar casos extremos o añadir pruebas según la revisión realizada. |
| Termina de forma ordenada una ejecución en curso y los procesos del trabajador correspondiente. |
| Comprueba la disponibilidad del punto de acceso del modelo local, el estado de la CLI de OpenCode y la configuración del modelo activa. |
| Consulta los resultados pasados, la duración y las tasas de éxito de delegación para un repositorio. |
🚀 Inicio rápido
1. Prerrequisitos
Node.js:
>= 20.0.0CLI de OpenCode: instalada y accesible en
PATH(connpm i -g opencode-aio un binario).Modelo de inferencia local: un endpoint compatible con OpenAI en ejecución (por ejemplo, DeepSeek V4 Flash, Qwen 2.5/3.5 en vLLM, Ollama, SGLang o clústeres duales DGX Spark).
2. Instalar y compilar
git clone https://github.com/aditya1503/LocalForge.git
cd LocalForge
npm install
npm run build3. Verificar el estado
npm run dev
# or run health check
tsx tests/v2.test.ts4. Conectar a tu cliente de IA
LocalForge incluye un script automatizado de registro de clientes:
# Register with OpenAI Codex / Antigravity
node scripts/register-client.mjs antigravity
# Register with Claude Code
node scripts/register-client.mjs claude-code
# Register with Claude Desktop
node scripts/register-client.mjs claude-desktop⚙️ Configuración
Define las variables de entorno en tu entorno o en la configuración del cliente:
Variable | Por defecto | Descripción |
|
| Identificador del modelo pasado a OpenCode. |
|
| Punto de control de estado del servidor de inferencia local. |
| directorio de trabajo actual | Lista blanca de directorio raíz para prevenir el acceso a rutas fuera de ella. |
|
| Tiempo de ejecución máximo antes de la cancelación automática. |
📊 Telemetría y registros
Cada tarea finalizada registra automáticamente su telemetría en state/ledger.jsonl. Ejecuta la herramienta de resumen integrada para analizar los ahorros:
npm run rollupEjemplo de salida:
=== LocalForge Telemetry Rollup ===
Total Tasks: 42
Success Rate: 95.2%
Avg Task Duration: 28.4s
Estimated Cloud Tokens Saved: ~1.85M tokens
Top Task Classes: unit-test-generation, bugfix, refactoring🎨 Infografía interactiva de la arquitectura
Este repositorio incluye un diagrama infográfico interactivo independiente en HTML que visualiza el flujo completo de delegación de MCP:
open index.html📄 Licencia
Licencia MIT. Diseñado y mantenido por ADIS (Artificially Developed Intelligence Services).
This server cannot be installed
Maintenance
Resources
Unclaimed servers have limited discoverability.
Looking for Admin?
If you are the server author, to access and configure the admin panel.
Related MCP Servers
- AlicenseNot gradedqualityDmaintenanceEnables Claude to delegate coding tasks to local Ollama models, reducing API token usage by up to 98.75% while leveraging local compute resources. Supports code generation, review, refactoring, and file analysis with Claude providing oversight and quality assurance.29422AGPL 3.0
- AlicenseAqualityDmaintenanceOptimizes token costs by intelligently delegating low-complexity tasks to local LLMs via LiteLLM, enabling cost-effective development workflows.31MIT
- FlicenseNot gradedqualityBmaintenanceRoutes code generation tasks between local models and Claude Cloud, optimizing cost by handling simple tasks locally and reserving cloud thinking for complex tasks.
- AlicenseBqualityCmaintenanceEnables coding agents like Claude Code and Codex to offload boilerplate generation, summarization, and other bounded text tasks to local or cheap cloud LLMs, keeping the frontier agent in charge of judgment and code edits.92MIT
Related MCP Connectors
Agentic code review, no signup to try: reality gates + frontier-model review, with veto.
Coding agents from Claude Code, Cursor and Codex claim jobs and lock files on one shared board.
Reduces AI Agent token usage by 40% via three-stage SOP workflow.
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/aditya1503/MCPRelay'
If you have feedback or need assistance with the MCP directory API, please join our Discord server