claude-delegate-local-mcp
claude-delegate-local-mcp
MCP-сервер, который позволяет Claude Code передавать работу локальной модели, которую вы размещаете у себя.
Массовая, механическая, по большей части «читающая» работа — чтение подсистемы, написание тестов, механические рефакторинги, первичное ревью — стоит облачных токенов, даже когда требуемые рассуждения довольно скромные. Сервер переносит этот класс работы на ваше собственное железо, где она практически бесплатна, а Claude остаётся для тех частей, где он нужен.
Статус: ранняя стадия. Конфигурация, реестр моделей и инструменты документации реализованы и протестированы. Сами инструменты делегирования ещё не построены. Смотрите STATUS.md, где всё на самом деле, и PLAN.md — маршрут.
Как это работает
Две формы делегирования, и вторая — интересная:
One-shot — содержимое файлов читается на сервере и встраивается в единый запрос. Модель отвечает; байты никогда не попадают в контекст Claude. Хорошо подходит для ревью, резюме, объяснения.
Агентный — локальная модель получает собственные
read_file,write_fileиrun_bashи итерирует. Она пишет код, запускает ваш набор тестов, читает реальную ошибку, исправляет её и запускает снова — столько итераций, сколько нужно, при нулевой стоймости облачных токенов — а затем передаёт результат на ревью Claude.
Именно второй цикл — причина существования оболочки (shell) и того, что run_bash ограничен губblewrap в песочнице с пустым корнем, с отключённой по умолчанию сетью. Если bubblewrap недоступен, сервер отказывается выполнять шелловые команды, а не запускает их без ограничений.
Сервер также сам фиксирует реальные коды выхода процессов и сообщает об них отдельно от того, что бы модель ни заявляла в своём ответе. Модели неверно сообщают о результатах команд; вся идея самопроверки рушится без достоверной основы.
Related MCP server: cctx
Чем это не является
Не облачный роутер. Поставляется один формат бэкенда — совместимый с OpenAI. Совместимые с Anthropic конечные точки — это планируемое добавление за существующим швом, а не текущая функция.
Не способ запускать Claude Code против другой модели. Он делегирует задачи; Claude Code остаётся Claude Code.
Не песочница для ненадёжного кода. Он ограничивает модель, которую вы выбрали для работы с workspace, который вы выбрали открыть.
Требования
Локальный эндпоинт, совместимый с OpenAI (это было построено против vLLM, обслуживающего DeepSeek V4 Flash на двух машинах класса DGX-Spark, но ничего не зависит от этого конкретного стека).
Python 3.11+.
Linux, либо WSL2 на Windows —
bubblewrapработает только в Linux, и нет дешёвого эквивалента для Windows, поэтому сервер соответствует там, даже когда Claude Code не работает.
Установка
git clone https://github.com/ComputerSaysNull/claude-delegate-local-mcp
cd claude-delegate-local-mcp
cp .env.example .env # then set DELEGATE_WORKSPACE_ROOTS
cp models.toml.example models.toml # then set your endpoint
python -m venv .venv && .venv/bin/pip install -e ".[dev]"
python scripts/install_hooks.py # optional, gives the gate at commit time.env и models.toml намеренно в .gitignore: они содержат имя хоста, а имя хоста идентифицирует вашу машину так же точно, как адрес.
На Windows, с сервером в WSL2
wsl --install -d Ubuntu-24.04Затем внутри Ubuntu — и проверяйте, а не предполагайте, потому что две из эти шag тихо не срабатывают:
sudo apt install -y bubblewrap python3 python3-venv git
bwrap --unshare-all --ro-bind /usr /usr --ro-bind /etc /etc --proc /proc \
--dev /dev --tmpfs /tmp --symlink usr/bin /bin --symlink usr/lib /lib \
--symlink usr/lib64 /lib64 -- /bin/echo ok # must print: ok
getent hosts YOUR-HEAD-NODE # must resolve in WSL, not just WindowsСимлинк usr/lib64 не являет ся необязателним на x86-64: без него ничто динамический слинкованное не запусткается, и ошибка обвиняет исполняемый файл, а не отсуствующий загрузчик.
Регистрация в Claude Code
Натичный Linux:
{ "mcpServers": { "delegate-local": {
"command": "claude-delegate-local-mcp",
"timeout": 900000
} } }Windows, сервер в WSL2:
{ "mcpServers": { "delegate-local": {
"command": "wsl.exe",
"args": ["-d", "Ubuntu-24.04", "-e", "claude-delegate-local-mcp"],
"timeout": 900000
} } }timeout измеряется в миллисекунндах. Лмит по реальному времени по умолчанию щедрый, но длительное делегирование может вызыть отденый 30 — минутный idle таймаут stdio — сервер отправляет уведомления о прогрессе на каждом шagе, чтобы этого не происходило. См. docs/TROUBLESHOOTING.md.
Документация
Как частети сопоставляются и почему | |
Все настройки (генерируется) | |
Реестр и добавление модели | |
Адениськие файлы и политика путей | |
Симптом → причина → исправление | |
Нумерованные решении, новайшие сверху | |
Что потребо вало настоящей работы, чтобы расбраться | |
Настройка и соглашения |
Ни один дефолт конфиг его не описывается нигde, кро ме docs/CONFIGURATION.md, который генерируется из кода, который его опрелеляет. Если вы найдёте тот самый конфиг повторённым где-либо сщё, это баг — CLAUDE.md объясняет схему.
Происходдение и лицenзия
MИН. Производная работа, а не не зависимостимая реализация: значитель часть кода была портиирована из fegone/claude-code-delegate-local и его форка mixicz, оба MIT. Иде́ контекстной предваршительной выгрезии по стороне сервера происходит от fjgbue/claude-delegator-deepseek-mcp. NOTICE фиксирует, что и отуда взято, возможность за могуществом.
This server cannot be installed
Resources
Unclaimed servers have limited discoverability.
Looking for Admin?
If you are the server author, to access and configure the admin panel.
Related MCP Servers
- AlicenseNot gradedqualityDmaintenanceEnables Claude to delegate coding tasks to local Ollama models, reducing API token usage by up to 98.75% while leveraging local compute resources. Supports code generation, review, refactoring, and file analysis with Claude providing oversight and quality assurance.29422AGPL 3.0
- AlicenseNot gradedqualityBmaintenanceEnables Claude Code to reduce token usage by 70-90% using a local LLM for codebase indexing, tool output compression, and turn summarization.352MIT
- AlicenseBqualityCmaintenanceEnables coding agents like Claude Code and Codex to offload boilerplate generation, summarization, and other bounded text tasks to local or cheap cloud LLMs, keeping the frontier agent in charge of judgment and code edits.92MIT
- AlicenseAqualityCmaintenanceEnables Claude Code to offload routine code generation and text processing tasks to a local Ollama LLM, saving Cloud API tokens and costs with automatic model selection and security features.11614Apache 2.0
Related MCP Connectors
Codebase intelligence for agents: 152 structured artifacts across 21 programs, one call.
Coding agents from Claude Code, Cursor and Codex claim jobs and lock files on one shared board.
Cross-agent artifact workspace with provenance across Claude Code, Codex, Cursor, LangGraph.
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/ComputerSaysNull/claude-delegate-local-mcp'
If you have feedback or need assistance with the MCP directory API, please join our Discord server