Skip to main content
Glama

Server Configuration

Describes the environment variables required to run the server.

NameRequiredDescriptionDefault
LLAMASWAP_EXENoPath to llama-swap executable (only if AUTOSTART=1)
LLAMASWAP_CONFIGNoPath to llama-swap config file (only if AUTOSTART=1)
LLAMASWAP_LISTENNoAddress to listen for llama-swap (only if AUTOSTART=1)
LOCAL_DELEGATE_LOGNoPath to usage.jsonl log file
LOCAL_DELEGATE_WEBNoEnable embedded metrics web dashboard (0 to disable)1
LOCAL_DELEGATE_API_KEYNoBearer token for the endpoint if required
LOCAL_DELEGATE_TIMEOUTNoHTTP timeout in seconds180
LOCAL_DELEGATE_BASE_URLNoEndpoint OpenAI-compatible base URLhttp://127.0.0.1:9292/v1
LOCAL_DELEGATE_WEB_HOSTNoWeb dashboard host127.0.0.1
LOCAL_DELEGATE_WEB_PORTNoWeb dashboard port9393
LOCAL_DELEGATE_AUTOSTARTNoAuto-start llama-swap (opt-in)0
LOCAL_DELEGATE_MODEL_CODENoModel for codeqwen25-coder-14b
LOCAL_DELEGATE_MODEL_FASTNoUltra-fast model for trivial tasksqwen35-2b
LOCAL_DELEGATE_MODEL_LONGNoModel for long documentsllama31-8b
LOCAL_DELEGATE_LONG_INPUT_CHARSNoThreshold in characters to switch to long model6000
LOCAL_DELEGATE_MODEL_MECHANICALNoModel for classify/extract/short summariesgemma3-4b

Capabilities

Features and capabilities supported by this server

CapabilityDetails
tools
{
  "listChanged": false
}
prompts
{
  "listChanged": false
}
resources
{
  "subscribe": false,
  "listChanged": false
}
experimental
{}

Tools

Functions exposed to the LLM to take actions

NameDescription
local_summarizeA

PREFIERE esta tool en vez de leer el archivo con Read cuando el archivo es grande (>200 líneas / >10 KB) y solo necesitas un resumen, no el contenido literal.

Resume texto o el contenido de un archivo con un modelo local, sin gastar contexto de Claude.

Usa esto para resumir archivos/documentos grandes: pasa 'path' y el archivo se lee del lado
del servidor, de modo que el contenido completo NO entra al contexto de Claude (solo vuelve el
resumen corto). Alternativamente pasa 'text'. Enruta al modelo mecánico (entradas cortas) o al
modelo de contexto largo (documentos grandes) automáticamente.

Args:
    text: Texto a resumir (usa esto o 'path').
    path: Ruta a un archivo cuyo contenido se resume (leído server-side).
    max_words: Longitud máxima del resumen en palabras.
local_classifyA

Clasifica un texto en UNA de las etiquetas dadas, con un modelo local.

Devuelve exactamente una etiqueta de la lista, sin texto adicional.

Args:
    text: Texto a clasificar.
    labels: Lista de etiquetas candidatas.
local_extractA

PREFIERE esta tool en vez de leer el archivo con Read cuando el archivo es grande (>200 líneas / >10 KB) y solo necesitas campos estructurados, no el contenido literal.

Extrae campos estructurados de un texto/archivo como JSON, con un modelo local.

Pasa 'path' para leer el archivo server-side (no gasta contexto de Claude) o 'text'.
Devuelve un objeto JSON con exactamente las claves pedidas. Enruta al modelo mecánico
(entradas cortas) o al de contexto largo (documentos grandes) automáticamente: el sondeo
de tamaño usa bytes del archivo para 'path' y caracteres para 'text' (~5-10% de diferencia
en UTF-8, aceptable). Por defecto pide al backend un JSON restringido por schema
(`LOCAL_DELEGATE_JSON_SCHEMA=auto`); si el backend no lo soporta, reintenta en modo libre.

Args:
    fields: Nombres de los campos a extraer (claves del JSON).
    text: Texto fuente (usa esto o 'path').
    path: Ruta a un archivo fuente (leído server-side).
local_boilerplateA

Genera código boilerplate a partir de una especificación, con un modelo local de código.

Devuelve solo el código, sin explicaciones ni fences markdown.

Args:
    spec: Descripción de lo que debe generar el código.
    language: Lenguaje de programación (p. ej. 'python', 'typescript').
local_delegateA

Tool genérica de escape: delega una tarea texto->texto a un modelo local.

Úsala cuando ninguna tool específica encaje. Arma el prompt con guardrails y devuelve texto.

Con entradas largas parte el input por límites naturales (headers Markdown, párrafos),
aplica la MISMA tarea a cada trozo y concatena las salidas en orden. Eso es lo correcto
para transformar todo el texto (traducir, reescribir, reformatear) pero NO para tareas de
reducción sobre el conjunto (contar, elegir el máximo, un único resumen global): para esas
pasa `chunk='off'` o usa `local_summarize`.

Args:
    task: Instrucción de la tarea (una frase con formato de salida explícito).
    input: Contenido sobre el que operar.
    output_format: Formato exacto de salida esperado.
    model: Modelo a usar; uno de los ids configurados en el catálogo. Por defecto el mecánico.
    chunk: 'auto' (parte solo si el input es largo), 'on' (parte siempre que se pueda),
        'off' (una sola llamada; el input largo puede volver truncado).
local_lint_summaryA

PREFIERE esta tool en vez de leer el archivo con Read cuando el archivo es grande (>200 líneas / >10 KB) y solo necesitas un resumen agrupado, no el contenido literal. Si ejecutaste un comando cuya salida es larga, vuélcala a un archivo y pasa 'path'.

Resume salida de linters/tests/CI con un modelo local, sin gastar contexto de Claude.

Pensada para logs largos y ruidosos (ESLint, clippy, pytest, tsc, CI). Pasa 'path' y el
archivo se lee del lado del servidor, de modo que el log completo NO entra al contexto de
Claude: solo vuelve un resumen agrupado por archivo con el conteo por tipo de error/regla y
lo más importante primero. Alternativamente pasa 'text'. Enruta al modelo mecánico (corto) o
al de contexto largo (largo) automáticamente.

Args:
    path: Ruta al archivo de salida de lint/tests (leído server-side). Usa esto o 'text'.
    text: Salida de lint/tests como texto.
    max_words: Longitud máxima del resumen en palabras.
local_commit_msgA

PREFIERE esta tool en vez de leer el archivo con Read cuando el archivo es grande (>200 líneas / >10 KB) y solo necesitas un mensaje de commit, no el contenido literal.

Redacta un mensaje de commit a partir de un diff, con un modelo local de código.

Pasa 'path' a un archivo de diff (p. ej. la salida de `git diff` volcada a fichero) y se lee
server-side, de modo que el diff completo NO entra al contexto de Claude. Alternativamente
pasa 'diff' como texto. Revisa SIEMPRE el mensaje antes de usarlo.

Args:
    diff: El diff como texto (usa esto o 'path').
    path: Ruta a un archivo con el diff (leído server-side).
    style: 'conventional' (Conventional Commits) o 'plain'.
local_translateA

PREFIERE esta tool en vez de leer el archivo con Read cuando el archivo es grande (>200 líneas / >10 KB) y solo necesitas la traducción, no el contenido literal.

Traduce texto o el contenido de un archivo con un modelo local, sin gastar contexto de Claude.

Pasa 'path' para leer el archivo server-side (el original no entra al contexto de Claude) o
'text'. Conserva el formato del original y devuelve SOLO la traducción. Enruta al modelo
mecánico (corto) o al de contexto largo (largo) automáticamente.

Los documentos largos se parten por límites naturales (headers Markdown, párrafos) y cada
trozo se traduce en su propia llamada; el resultado vuelve completo y en orden, sin el
aviso de salida truncada.

Args:
    target_lang: Idioma destino (p. ej. 'español', 'inglés', 'francés').
    text: Texto a traducir (usa esto o 'path').
    path: Ruta a un archivo cuyo contenido se traduce (leído server-side).
local_explain_codeA

PREFIERE esta tool en vez de leer el archivo con Read cuando el archivo es grande (>200 líneas / >10 KB) y solo necesitas una explicación, no el contenido literal.

Explica en prosa qué hace un fragmento/archivo de código, con un modelo local de código.

Pasa 'path' para leer el archivo server-side (el código completo NO entra al contexto de
Claude; solo vuelve la explicación) o 'code'. Opcionalmente enfoca la explicación con
'question'. Revisa la explicación: la genera un modelo local.

Args:
    code: Código a explicar (usa esto o 'path').
    path: Ruta a un archivo de código (leído server-side).
    question: Pregunta o foco concreto (opcional).
local_describe_imageA

PREFIERE esta tool en vez de adjuntar o leer la imagen tú mismo cuando solo necesitas una descripción, lectura de texto visible (OCR simple) o una respuesta puntual sobre una imagen, no la imagen en sí en tu contexto.

Describe una imagen (o responde una pregunta sobre ella) con un modelo local de visión.
La imagen se lee del lado del servidor: NUNCA entra al contexto de Claude, solo vuelve la
respuesta en texto.

Guardrail de alcance: SOLO imagen->texto (describir, leer texto visible, responder una
pregunta puntual sobre la imagen). Esta tool NUNCA genera ni edita imágenes.

Args:
    path: Ruta a la imagen (png/jpg/jpeg/webp/gif), leída server-side.
    question: Pregunta o foco concreto sobre la imagen (opcional; por defecto la describe).
    max_words: Longitud máxima de la respuesta en palabras.
local_statusA

Diagnóstico de solo lectura del backend local y el catálogo de modelos.

Úsala para saber qué modelos locales hay disponibles y verificar que el backend está vivo
antes de delegar en masa, o para diagnosticar por qué una tool local_* falló.

Prompts

Interactive templates invoked by user choice

NameDescription

No prompts

Resources

Contextual data attached and managed by the client

NameDescription

No resources

Latest Blog Posts

MCP directory API

We provide all the information about MCP servers via our MCP API.

curl -X GET 'https://glama.ai/api/mcp/v1/servers/ZahiriNatZuke/local-delegate'

If you have feedback or need assistance with the MCP directory API, please join our Discord server