Skip to main content
Glama

Models MCP

Durchsuche, vergleiche und prüfe KI-Modelle nach Preis, Kontextfenster und Fähigkeiten. Ein MCP-Server über den models.dev-Katalog (models.dev/api.json), damit dein Agent immer aktuelle Modelldaten hat, ohne dass du eine Liste manuell pflegst.

models.dev selbst liefert keinen MCP-Server, nur eine JSON-API und ein TypeScript-SDK zum Lesen. Das hier schließt diese Lücke.

Läuft auf zwei Arten aus demselben Tool-Code:

  • stdio (src/index.ts) für lokale MCP-Clients

  • Cloudflare Worker (src/worker.ts) als Remote-Streamable-HTTP-Endpunkt unter /mcp

Tools

Tool

Was es tut

list_providers

Listet jeden Anbieter (anthropic, openai, google, ...) mit Modellanzahlen auf

find_models

Filtert Modelle nach Name, Anbieter, minimalem Kontextfenster, maximalen Eingabekosten oder Fähigkeits-Flags (reasoning, tool_call, attachment)

get_model

Vollständige Metadaten für ein Modell, anhand der provider/model-ID

compare_models

Nebeneinander-Vergleich von 2-6 Modellen bei Preis, Kontext und Fähigkeiten

refresh_catalog

Erzwingt einen erneuten Abruf und umgeht den 1-Stunden-Cache

Installation

npm install
npm run build

Eigenständig über stdio ausführen (zum Testen)

npm start

Es spricht MCP über stdio, du wirst also nicht viel direkt sehen; nutze den MCP Inspector, um daran herumzutesten:

npx @modelcontextprotocol/inspector node dist/index.js

Auf Cloudflare Workers hosten

Der Worker-Einstiegspunkt (src/worker.ts) stellt dieselben Tools über Streamable HTTP unter /mcp bereit, mit:

  • Katalog-Caching in der Workers Cache API (caches.default) mit einer 1-Stunden-TTL, geteilt über Anfragen und Isolate hinweg.

  • Pro-IP-Ratenbegrenzung über ein Workers-Rate-Limiting-Binding: 60 Anfragen/Minute pro IP, durchgesetzt pro Cloudflare-Standort. Überzählige Anfragen erhalten 429 mit Retry-After: 60.

# local dev at http://localhost:8787/mcp
npm run dev:worker

# deploy
npm run deploy

Nach dem Deployment ist dein Endpunkt https://models-mcp.<your-subdomain>.workers.dev/mcp.

Richte MCP-Clients darauf aus:

Claude Code:

claude mcp add --transport http models-mcp https://models-mcp.<your-subdomain>.workers.dev/mcp

Generische Client-Konfiguration (alles, was Streamable HTTP spricht):

{
  "mcpServers": {
    "models-mcp": {
      "url": "https://models-mcp.<your-subdomain>.workers.dev/mcp"
    }
  }
}

Für reine stdio-Clients (Claude Desktop) überbrücke mit mcp-remote:

{
  "mcpServers": {
    "models-mcp": {
      "command": "npx",
      "args": ["mcp-remote", "https://models-mcp.<your-subdomain>.workers.dev/mcp"]
    }
  }
}

Keinerlei API-Schlüssel erforderlich. Alle Daten stammen vom öffentlichen models.dev/api.json-Endpunkt.

Tests

npm test

Abgedeckt werden der Katalog-Client (Flattening, TTL-Caching, erzwungenes Aktualisieren, Fallback auf veraltete Daten bei Fehlern, ID-Auflösung) und alle fünf Tools Ende-zu-Ende über eine echte MCP-Client-Sitzung über einen In-Memory-Transport.

Anmerkungen zu den Daten

  • Der Katalog wird 1 Stunde lang gecacht: in der Workers Cache API, wenn gehostet, im Prozessspeicher über stdio. Rufe refresh_catalog auf, um ein Update zu erzwingen. Wenn ein erneuter Abruf fehlschlägt, wird weiterhin der letzte gute Katalog ausgeliefert.

  • models.dev veröffentlicht kein versioniertes Schema für Konsumenten, daher sind die Typen in src/types.ts bewusst locker gehalten (Index-Signaturen erhalten alle Felder, die nicht explizit typisiert sind).

  • Modell-IDs folgen der provider/model-Konvention, die von AI SDK und OpenCode verwendet wird, z. B. anthropic/claude-sonnet-4-5. get_model und compare_models akzeptieren auch eine nackte Modell-ID, wenn sie über Anbieter hinweg eindeutig ist.

Mögliche Erweiterungen

  • Ein list_facets-Tool (Modalitäten, Tokenizer), ähnlich dem, was andere Modellkatalog-MCPs bereitstellen.

  • Ein test_model-Tool, das einen Live-Aufruf über den von dir konfigurierten Anbieter-Schlüssel macht, für Latenz-/Kosten-Plausibilitätsprüfungen.

  • OAuth oder Cloudflare Access vor dem Worker, falls du ihn privat halten möchtest.

-
license - not tested
Not graded
quality - not tested
B
maintenance

Maintenance

Maintainers
Response time
Release cycle
Releases (12mo)
Commit activity

Resources

Unclaimed servers have limited discoverability.

Looking for Admin?

If you are the server author, to access and configure the admin panel.

Related MCP Connectors

  • Search 200+ UnoRouter models (most free), check pricing, and chat through one key

  • Search, compare, and find alternatives across a curated catalog of 1,100+ AI tools.

  • @latest documentation and code examples to 9000+ libraries for LLMs and AI code editors in a singl…

View all MCP Connectors

Latest Blog Posts

MCP directory API

We provide all the information about MCP servers via our MCP API.

curl -X GET 'https://glama.ai/api/mcp/v1/servers/QAInsights/models-mcp'

If you have feedback or need assistance with the MCP directory API, please join our Discord server