Skip to main content
Glama

Switchback MCP

Servidor MCP para Switchback — clasifica los turnos de agentes de IA por complejidad y elige el modelo más barato que pueda manejarlos. Funciona con Claude Desktop, Cursor, Cline y cualquier cliente MCP.

npm Powers VibeKit

Creado por VibeKit — el mismo enrutador en cascada que impulsa cada turno "Auto" en nuestro producto alojado. Más información →

Qué hace

Expone dos herramientas a través del Model Context Protocol:

  • classify_turn — dado un mensaje del usuario, devuelve {tier: 0|1|2, why, fallback, durationMs}. Úsalo cuando decidas si gastar en un modelo insignia o quedarte con uno barato para el siguiente paso del agente.

  • recommend_model — dado un mensaje del usuario + una escalera de modelos (barato → insignia), devuelve el modelo más barato de la escalera que pueda manejarlo de manera plausible. Envoltorio de conveniencia alrededor de classify_turn.

Ambas herramientas realizan una única llamada a un modelo pequeño a través de OpenRouter (por defecto: openai/gpt-5.4-mini, ~$0.0001/llamada). Fail-soft: cualquier error devuelve el nivel 1 con fallback: true en lugar de bloquear a tu agente.

Related MCP server: oracle-models

Instalación

npm install -g vibekit-switchback-mcp

Configuración

Configura tu clave de OpenRouter (obtén una en https://openrouter.ai/keys):

export OPENROUTER_API_KEY=sk-or-...

Opcional: anula el modelo clasificador:

export SWITCHBACK_CLASSIFIER_MODEL=anthropic/claude-haiku-4.5

Claude Desktop

Añade a tu ~/Library/Application Support/Claude/claude_desktop_config.json:

{
  "mcpServers": {
    "switchback": {
      "command": "npx",
      "args": ["-y", "vibekit-switchback-mcp"],
      "env": {
        "OPENROUTER_API_KEY": "sk-or-..."
      }
    }
  }
}

Cursor / Cline / otros

Cualquier cliente MCP que admita servidores stdio. Misma invocación npx.

Ejemplos de llamadas

classify_turn:

{
  "userMessage": "rebuild the auth flow with passkeys"
}

devuelve:

{
  "tier": 2,
  "why": "architectural rework + new auth method",
  "fallback": false,
  "durationMs": 412
}

recommend_model:

{
  "userMessage": "fix typo in README",
  "ladder": [
    "openai/gpt-5.4-mini",
    "openai/gpt-5.4",
    "openai/gpt-5.5"
  ]
}

devuelve:

{
  "recommended_model": "openai/gpt-5.4-mini",
  "tier": 0,
  "ladder_size": 3,
  "classifier": { "tier": 0, "why": "trivial copy edit", "fallback": false, "durationMs": 318 }
}

Cuándo usarlo

  • Agentes de múltiples pasos donde puedas intercambiar modelos entre rondas.

  • Productos estilo BYOK donde quieras mantener todo el enrutamiento dentro de la marca elegida por el usuario: pasa una escalera bloqueada por marca para cada usuario.

  • Orquestadores conscientes del costo que quieran evitar gastar tarifas de modelo insignia en turnos triviales.

Cuándo NO usarlo

  • Completions de chat de una sola vez donde no puedas cambiar de modelo después de la primera llamada: usa auto de OpenRouter o NotDiamond/Martian en su lugar.

  • UX crítico en latencia con primer token en menos de 200 ms — el clasificador añade 200-500 ms.

Licencia

MIT. Consulta LICENSE.

Creado por VibeKit. La biblioteca principal es vibekit-switchback — este paquete es el envoltorio MCP.

A
license - permissive license
Not graded
quality - not tested
C
maintenance

Maintenance

Maintainers
Response time
Release cycle
Releases (12mo)
Commit activity

Resources

Unclaimed servers have limited discoverability.

Looking for Admin?

If you are the server author, to access and configure the admin panel.

Related MCP Servers

  • A
    license
    A
    quality
    D
    maintenance
    Classifies development task complexity (LIGHT/MEDIUM/HEAVY) and recommends the most cost-efficient AI model per provider, enabling optimized model selection for coding tasks.
    3
    666
    MIT
  • A
    license
    A
    quality
    D
    maintenance
    Optimizes token costs by intelligently delegating low-complexity tasks to local LLMs via LiteLLM, enabling cost-effective development workflows.
    3
    1
    MIT
  • A
    license
    A
    quality
    C
    maintenance
    Pre-execution cost estimation for LLM agent workflows, providing cost estimates before running tasks and improving accuracy over time through calibration.
    6
    2
    MIT

View all related MCP servers

Related MCP Connectors

View all MCP Connectors

Latest Blog Posts

MCP directory API

We provide all the information about MCP servers via our MCP API.

curl -X GET 'https://glama.ai/api/mcp/v1/servers/VibeKit-Bot/vibekit-switchback-mcp'

If you have feedback or need assistance with the MCP directory API, please join our Discord server