Skip to main content
Glama
OptimNow

OptimToken MCP

Official
by OptimNow

OptimToken MCP

Erstellt von OptimNow. Frag einen KI-Assistenten, was ein Modell oder eine Instanz tatsächlich kostet, und du bekommst eine datierte, belegte Zahl statt einer Zahl, die das Modell aus seinen Trainingsdaten kennt.

CI MCP Server ChatGPT Apps Node Prices ![License: MIT](https://img.shields.io/badge/License-MIT-yellow.svg GitHub Stars


In 30 Sekunden verbinden

Der Server ist gehostet, es gibt also nichts zu installieren.

https://ai-pricing-hub-mcp-9604f763.alpic.live/

Client

So fügst du ihn hinzu

claude mcp add --transport http optimtoken https://ai-pricing-hub-mcp-9604f763.alpic.live/

Einstellungen → Connectors → Benutzerdefinierten Connector hinzufügen, füge die obige URL ein

Einstellungen → Connectors → Hinzufügen, füge die URL ein. Vergleiche werden als interaktive Widgets dargestellt

Füge einen HTTP-MCP-Server-Eintrag hinzu, der auf die URL zeigt.

Dann frag einfach:

„Wir senden 200.000 Support-Tickets pro Monat mit jeweils etwa 1.500 Eingabe-Tokens. Welches Modell bietet mir die beste Qualität pro Euro, und was würde es kosten?"


Related MCP server: CloudCost MCP Server

Warum es das gibt

Modellpreise ändern sich wöchentlich, und die Vorstellung eines Sprachmodells davon ist bei seinem Trainingsstand eingefroren. Frag eines, was Claude oder GPT kostet, und du bekommst eine selbstbewusste Antwort, die vor einigen Monaten stimmte, ohne Datum und ohne Möglichkeit, es zu überprüfen. Gleiches gilt für Cloud-Instanzpreise, die zusätzlich je nach Region variieren, und zwar auf eine Weise, die niemand auswendig kennt.

Dieser Server ersetzt Erinnerung durch eine Nachschlagefunktion:

  • Live-Preise, keine erinnerten. Jede LLM-Zahl stammt aus dem OptimToken-Katalog, der 250+ Modelle verfolgt und täglich aktualisiert wird.

  • Korrigierte Preise. OptimToken führt ein verbindliches Preisarchiv, eine verifizierte Überschreibungstabelle, die gegen die Preislisten der Anbieter geprüft wird, und eine Anomalieprüfung, die bei den Halbpreis- und Doppelpreis-Ausreißern alarmiert, die Upstream-Feeds gelegentlich veröffentlichen. Dieser Server fragt diesen Katalog ab, anstatt Preise selbst neu abzuleiten.

  • Kosten pro Anfrage, nicht pro Million Tokens. Preis-pro-Token-Vergleiche verbergen das, wofür du tatsächlich zahlst. Die Tools wenden deine Token-Form, deine Cache-Trefferquote und Batch-Berechtigung an und liefern eine Zahl pro Anfrage und pro Monat.

  • Jede Antwort trägt ihre Herkunft. Welche Stufe sie bedient hat und ob die Preise verifiziert wurden.


Tools

Tool

Was es beantwortet

compare-llm-models

„Was gibt es da draußen?" Durchsuche und filtere den Katalog nach Preis, Qualität (Chatbot Arena ELO), Effizienz und Fähigkeiten, mit einer Selbsthosting-Fähigkeit, die aus der Lizenz abgelesen wird.

recommend-llm-model

„Sag mir einfach, welches." Eine bewertete Top-3 für eine Arbeitslast unter deinen Einschränkungen (Budget, Mindest-ELO, erforderliche Fähigkeit, Selbsthosting), jeweils mit einer Aufschlüsselung pro Einschränkung, ob erfüllt oder verletzt, als Beleg. Überforderte Abfragen liefern die nächsten Verfehlungen, entsprechend gekennzeichnet.

compare-models-side-by-side

„Wie schneiden diese spezifischen ab?" 2 bis 4 benannte Modelle über alle 8 Anwendungsfallprofile bei einem gewählten Monatsvolumen, Listen- und optimierte Kosten für jedes.

estimate-llm-cost

„Was wird uns das pro Monat kosten?" Kosten pro Anfrage und monatlich für dein eigenes Volumen, Token-Form, Cache-Trefferquote und Batch-Berechtigung.

compare-compute-pricing

„Worauf sollten wir es ausführen?" Compute-Instanzpreise bei AWS, Azure, GCP, OCI, OVH, DigitalOcean und Alibaba, nach Region und Kategorie.

Alle fünf sind schreibgeschützt und benötigen keine Anmeldedaten. Nichts, was du sendest, wird gespeichert.

Anwendungsfallprofile werden mit realistischen Token-Formen geliefert, sodass du sie nicht erfinden musst: Support-Ticket, Wissens-Q&A, Besprechungszusammenfassung, Marketing-Inhalte, Programmieraufgabe, Rechnungsverarbeitung, Anrufzusammenfassung, Agenten-Workflow.


Woher die Zahlen kommen

optimtoken.optimnow.io ist die einzige Quelle der Wahrheit. Wenn es nicht erreichbar ist, degradiert der Server in Stufen, anstatt zu scheitern, und gibt an, welche Stufe er verwendet hat.

Tool

Tier 1

Tier 2

Tier 3

LLM-Tools

GET /api/llm-models

OpenRouter direkt

eingebetteter Snapshot

Compute-Tool

GET /api/pricing?region=

nicht verfügbar

eingebetteter Snapshot (137 Zeilen)

Stufen 2 und 3 liefern unkorrigierte Preise, und das ist wichtiger, als es klingt. Ein Upstream-Feed veröffentlichte einmal ein Frontier-Modell zum halben tatsächlichen Listenpreis, was jede daraus abgeleitete Monatszahl halbiert. Daher trägt jede Antwort ein provenance-Objekt mit pricesVerified, und die unteren Stufen setzen einen Hinweis an den Anfang der Antwort. Ein Fallback sollte niemals stillschweigend die Korrektheit herabsetzen.

Stufe 1 wird nur akzeptiert, wenn der Katalog meldet, dass er selbst frische Upstream-Daten liefert. Wenn die Website auf ihrem eigenen Fallback läuft, enthält sie keine Korrekturen, und dieser Server behandelt sie entsprechend.


Lokale Entwicklung

Erfordert Node.js 24+.

npm install
npm run dev              # Skybridge dev server + MCP inspector at localhost:3000
npm test                 # schema conformance, serialisation precision, data sources
npm run build            # widgets + server

Der statische Fallback-Katalog wird von Hand aktualisiert, nicht nach einem Zeitplan:

npm run refresh-fallback

Da es manuell ist, prüfe sein dataAsOf, bevor du einer Stufe-3-Antwort vertraust. Ein nicht aktualisierter Fallback altert still.

ai-pricing-hub-mcp/
├─ server/src/index.ts              # tool + widget registrations
├─ server/src/lib/optimtoken-api.ts # the one base URL constant, fetch and timeout discipline
├─ server/src/lib/                  # ranking, efficiency scoring, provenance, normalisation
├─ server/src/data/                 # static fallback pricing + region maps
└─ web/src/widgets/                 # React widgets rendered in the client

Erstellt mit Skybridge, bereitgestellt auf Alpic.


Der Rest der Familie

OptimToken

Die Web-App. Gleicher Katalog, vollständige Benutzeroberfläche, ein KI-Berater und eine öffentliche JSON-API.

AI ROI Calculator

Rechnet sich der KI-Geschäftsfall. Gleiche Preise, plus Harness-Kosten und Wertmodellierung.

cloud-finops-skills

FinOps-Wissen für KI-Agenten: AWS, Azure, GCP, KI-Inferenz, SaaS.

finops-mcp-resources

MCP-Server, Tutorials und Client-Anleitungen für Cloud-Kostenarbeit.


Lizenz

Veröffentlicht unter der MIT-Lizenz.

Preise, die von diesem Server geliefert werden, stammen aus Drittquellen und werden ohne Gewähr bereitgestellt. Prüfe die Preislisten der Anbieter, bevor du Ausgaben tätigst.


Fragen zu deiner eigenen KI- oder Cloud-Rechnung? Sprich mit OptimNow.

A
license - permissive license
Not graded
quality - not tested
A
maintenance

Maintenance

Maintainers
Response time
Release cycle
1Releases (12mo)
Commit activity

Resources

Unclaimed servers have limited discoverability.

Looking for Admin?

If you are the server author, to access and configure the admin panel.

Related MCP Servers

  • F
    license
    Not graded
    quality
    D
    maintenance
    Provides real-time AI model pricing, cost estimation, and budget management tools to help agents understand and optimize their spending. It enables agents to compare costs across multiple providers and select the most cost-effective models for specific tasks.
  • A
    license
    Not graded
    quality
    A
    maintenance
    Enables AI agents to parse multi-cloud infrastructure-as-code files, query real-time pricing from AWS, Azure, and GCP, and generate cost estimates and comparison reports.
    57
    MIT
  • F
    license
    A
    quality
    D
    maintenance
    Enables AI agents to compare AI model pricing plans, run cost scenarios, find break-even points, and get plan recommendations using TokenLens data.
    4

View all related MCP servers

Related MCP Connectors

  • Verified cloud cost forecasting for AI agents. AWS, GCP, Azure pricing matrix.

  • Verified cloud cost forecasting for AI agents. AWS, GCP, Azure pricing matrix.

  • See, price, and control every tool call your AI agents make: policy checks, cost, and audit tools.

View all MCP Connectors

Latest Blog Posts

MCP directory API

We provide all the information about MCP servers via our MCP API.

curl -X GET 'https://glama.ai/api/mcp/v1/servers/OptimNow/ai-pricing-hub-mcp'

If you have feedback or need assistance with the MCP directory API, please join our Discord server