Skip to main content
Glama

claude-delegate-local-mcp

MCP-сервер, который позволяет Claude Code передавать работу локальной модели, которую вы размещаете у себя.

Массовая, механическая, по большей части «читающая» работа — чтение подсистемы, написание тестов, механические рефакторинги, первичное ревью — стоит облачных токенов, даже когда требуемые рассуждения довольно скромные. Сервер переносит этот класс работы на ваше собственное железо, где она практически бесплатна, а Claude остаётся для тех частей, где он нужен.

Статус: ранняя стадия. Конфигурация, реестр моделей и инструменты документации реализованы и протестированы. Сами инструменты делегирования ещё не построены. Смотрите STATUS.md, где всё на самом деле, и PLAN.md — маршрут.

Как это работает

Две формы делегирования, и вторая — интересная:

  • One-shot — содержимое файлов читается на сервере и встраивается в единый запрос. Модель отвечает; байты никогда не попадают в контекст Claude. Хорошо подходит для ревью, резюме, объяснения.

  • Агентный — локальная модель получает собственные read_file, write_file и run_bash и итерирует. Она пишет код, запускает ваш набор тестов, читает реальную ошибку, исправляет её и запускает снова — столько итераций, сколько нужно, при нулевой стоймости облачных токенов — а затем передаёт результат на ревью Claude.

Именно второй цикл — причина существования оболочки (shell) и того, что run_bash ограничен губblewrap в песочнице с пустым корнем, с отключённой по умолчанию сетью. Если bubblewrap недоступен, сервер отказывается выполнять шелловые команды, а не запускает их без ограничений.

Сервер также сам фиксирует реальные коды выхода процессов и сообщает об них отдельно от того, что бы модель ни заявляла в своём ответе. Модели неверно сообщают о результатах команд; вся идея самопроверки рушится без достоверной основы.

Related MCP server: cctx

Чем это не является

  • Не облачный роутер. Поставляется один формат бэкенда — совместимый с OpenAI. Совместимые с Anthropic конечные точки — это планируемое добавление за существующим швом, а не текущая функция.

  • Не способ запускать Claude Code против другой модели. Он делегирует задачи; Claude Code остаётся Claude Code.

  • Не песочница для ненадёжного кода. Он ограничивает модель, которую вы выбрали для работы с workspace, который вы выбрали открыть.

Требования

  • Локальный эндпоинт, совместимый с OpenAI (это было построено против vLLM, обслуживающего DeepSeek V4 Flash на двух машинах класса DGX-Spark, но ничего не зависит от этого конкретного стека).

  • Python 3.11+.

  • Linux, либо WSL2 на Windowsbubblewrap работает только в Linux, и нет дешёвого эквивалента для Windows, поэтому сервер соответствует там, даже когда Claude Code не работает.

Установка

git clone https://github.com/ComputerSaysNull/claude-delegate-local-mcp
cd claude-delegate-local-mcp

cp .env.example .env                  # then set DELEGATE_WORKSPACE_ROOTS
cp models.toml.example models.toml    # then set your endpoint

python -m venv .venv && .venv/bin/pip install -e ".[dev]"
python scripts/install_hooks.py       # optional, gives the gate at commit time

.env и models.toml намеренно в .gitignore: они содержат имя хоста, а имя хоста идентифицирует вашу машину так же точно, как адрес.

На Windows, с сервером в WSL2

wsl --install -d Ubuntu-24.04

Затем внутри Ubuntu — и проверяйте, а не предполагайте, потому что две из эти шag тихо не срабатывают:

sudo apt install -y bubblewrap python3 python3-venv git
bwrap --unshare-all --ro-bind /usr /usr --ro-bind /etc /etc --proc /proc \
      --dev /dev --tmpfs /tmp --symlink usr/bin /bin --symlink usr/lib /lib \
      --symlink usr/lib64 /lib64 -- /bin/echo ok      # must print: ok
getent hosts YOUR-HEAD-NODE                           # must resolve in WSL, not just Windows

Симлинк usr/lib64 не являет ся необязателним на x86-64: без него ничто динамический слинкованное не запусткается, и ошибка обвиняет исполняемый файл, а не отсуствующий загрузчик.

Регистрация в Claude Code

Натичный Linux:

{ "mcpServers": { "delegate-local": {
    "command": "claude-delegate-local-mcp",
    "timeout": 900000
} } }

Windows, сервер в WSL2:

{ "mcpServers": { "delegate-local": {
    "command": "wsl.exe",
    "args": ["-d", "Ubuntu-24.04", "-e", "claude-delegate-local-mcp"],
    "timeout": 900000
} } }

timeout измеряется в миллисекунндах. Лмит по реальному времени по умолчанию щедрый, но длительное делегирование может вызыть отденый 30 — минутный idle таймаут stdio — сервер отправляет уведомления о прогрессе на каждом шagе, чтобы этого не происходило. См. docs/TROUBLESHOOTING.md.

Документация

docs/ARCHITECTURE.md

Как частети сопоставляются и почему

docs/CONFIGURATION.md

Все настройки (генерируется)

docs/MODELS.md

Реестр и добавление модели

docs/AGENTS.md

Адениськие файлы и политика путей

docs/TRoubleshooting.md

Симптом → причина → исправление

DECISIONS.md

Нумерованные решении, новайшие сверху

JOURNAL.md

Что потребо вало настоящей работы, чтобы расбраться

CONTRIBUTING.md

Настройка и соглашения

Ни один дефолт конфиг его не описывается нигde, кро ме docs/CONFIGURATION.md, который генерируется из кода, который его опрелеляет. Если вы найдёте тот самый конфиг повторённым где-либо сщё, это баг — CLAUDE.md объясняет схему.

Происходдение и лицenзия

MИН. Производная работа, а не не зависимостимая реализация: значитель часть кода была портиирована из fegone/claude-code-delegate-local и его форка mixicz, оба MIT. Иде́ контекстной предваршительной выгрезии по стороне сервера происходит от fjgbue/claude-delegator-deepseek-mcp. NOTICE фиксирует, что и отуда взято, возможность за могуществом.

A
license - permissive license
Not graded
quality - not tested
C
maintenance

Resources

Unclaimed servers have limited discoverability.

Looking for Admin?

If you are the server author, to access and configure the admin panel.

Related MCP Servers

  • A
    license
    Not graded
    quality
    D
    maintenance
    Enables Claude to delegate coding tasks to local Ollama models, reducing API token usage by up to 98.75% while leveraging local compute resources. Supports code generation, review, refactoring, and file analysis with Claude providing oversight and quality assurance.
    294
    22
    AGPL 3.0
  • A
    license
    Not graded
    quality
    B
    maintenance
    Enables Claude Code to reduce token usage by 70-90% using a local LLM for codebase indexing, tool output compression, and turn summarization.
    35
    2
    MIT
  • A
    license
    A
    quality
    C
    maintenance
    Enables Claude Code to offload routine code generation and text processing tasks to a local Ollama LLM, saving Cloud API tokens and costs with automatic model selection and security features.
    11
    61
    4
    Apache 2.0

View all related MCP servers

Related MCP Connectors

View all MCP Connectors

Latest Blog Posts

MCP directory API

We provide all the information about MCP servers via our MCP API.

curl -X GET 'https://glama.ai/api/mcp/v1/servers/ComputerSaysNull/claude-delegate-local-mcp'

If you have feedback or need assistance with the MCP directory API, please join our Discord server