Skip to main content
Glama
sohaibsohail98

mcp-context-inspector

mcp-context-inspector

Ein Drop-in-MCP-Server und Aufzeichnungsmodul für Ausführungsmetriken für jeden Tool-aufrufenden Agenten. Richten Sie die Schleife Ihres Agenten nach jedem Durchlauf auf record_session(prompt, model_id, loop_result) aus, und Sie erhalten kostenlos:

  • Einen echten MCP-Server (Streamable HTTP), mit dem jeder MCP-Client eine Verbindung herstellen kann – Claude Desktop, Cursor, Ihre eigene Chat-Oberfläche – der 7 schreibgeschützte Tools über Sitzungsverlauf, Kosten, Token-/Tool-Metriken bereitstellt, und...

  • Den Context Window Explorer – vollständige Transparenz darüber, was genau in das Kontextfenster des Modells gelangt ist, Block für Block, mit ehrlichen (explizit als geschätzt gekennzeichneten) Token-Zahlen, einem proportionalen segmentierten Balken und einem erweiterbaren Detailbereich pro Block:

    Context Window Explorer

    (Screenshot aus der Referenz-Chat-Oberfläche, die zusammen mit diesem Paket entwickelt wurde – sre-investigation-agent; das obige Panel ist das, was jeder MCP-Client erhält, sobald er get_context_timeline abfragt.)

Die meisten Agenten-Beobachtbarkeitstools zeigen Ihnen erneut Daten an, die Ihre eigene Oberfläche bereits angezeigt hat. Dieses Tool zeigt Ihnen etwas, das Sie normalerweise überhaupt nicht sehen können: System-Prompt vs. Tool-Spezifikationen vs. Reasoning vs. Tool-Aufruf/Ergebnis vs. finale Antwort, in der Reihenfolge, in der sie tatsächlich in den Kontext gelangt sind, mit einer laufenden Token-Gesamtsumme gegen das tatsächliche Kontextfenster des Modells – und welche dieser Blöcke für den Endbenutzer sichtbar sind vs. unsichtbarer Overhead.

Installieren

uv add mcp-context-inspector   # or: pip install mcp-context-inspector
# while co-developing locally against an editable checkout:
uv add --editable ../mcp-context-inspector

Related MCP server: ai-usage-metrics-mcp

Binden Sie es in Ihren Agenten ein

from metrics import store

session_id = store.record_session(prompt, model_id, loop_result)

loop_result ist das, was Ihre Agentenschleife zurückgibt – dieses Paket benötigt es nur, damit es wie folgt aussieht:

{
    "trace": [{"tool": "...", "args": {...}, "status": "ok"}, ...],
    "turns": [{"input_tokens": int, "output_tokens": int, "latency_ms": int}, ...],
    "input_tokens": int, "output_tokens": int, "total_tokens": int, "latency_ms": int,
    "context_blocks": [   # optional — omit and you just lose the Explorer, nothing crashes
        {"category": "system", "label": "...", "char_count": int, "token_estimate": int, "turn_n": int | None},
        ...
    ],
}

context_blocks-Kategorien: system, tools, user, reasoning, thinking, tool_call, tool_result (optional mit einem "status"-Schlüssel zur farblichen Kennzeichnung von Fehlern), answer.

Server ausführen

uv run python -m mcp_server.server

Kein MCP_AUTH_TOKEN gesetzt → generiert und gibt einen beim Start aus, dasselbe Vertrauensmodell wie der ausgegebene Token eines Jupyter-Servers. Setzen Sie ihn selbst für einen stabilen Wert über Neustarts hinweg. Richten Sie einen beliebigen MCP-Client auf http://127.0.0.1:8787/mcp mit Authorization: Bearer <token> aus.

Speicher-Backends

STORAGE_BACKEND=sqlite (Standard, lokale Entwicklung – data/metrics.db) oder STORAGE_BACKEND=dynamodb (setzen Sie METRICS_TABLE/AWS_REGION) – gleiche Funktionssignaturen in beiden Fällen, Aufrufer wissen nie, welches aktiv ist.

Die 7 MCP-Tools

get_session_metrics, get_token_breakdown, get_tool_metrics, get_agent_trace, get_cost_estimate, get_recent_sessions, get_context_timeline. Einfache REST-Äquivalente werden ebenfalls unter /api/* bereitgestellt – eine curl-freundliche Debugging-Alternative, die dieselben zugrunde liegenden metrics/store.py-Funktionen aufruft.

Verwandte Repos

sre-investigation-agent – die Referenz-Chat-Oberfläche und der Bedrock-Agent, aus dem dieses Paket extrahiert wurde und zusammen mit dem es entwickelt wird.

A
license - permissive license
-
quality - not tested
C
maintenance

Resources

Unclaimed servers have limited discoverability.

Looking for Admin?

If you are the server author, to access and configure the admin panel.

Related MCP Servers

  • A
    license
    A
    quality
    A
    maintenance
    MCP-native agent evaluation and observability server. Log traces, evaluate output quality with 12 built-in rules (PII detection, prompt injection, cost thresholds), and track agent costs. Real-time dashboard, OTel-compatible spans. Self-hosted, MIT licensed.
    9
    346
    7
    MIT
  • A
    license
    A
    quality
    B
    maintenance
    An MCP server that provides cost and reliability observability for LLM and agent workflows. It records model calls and allows querying and aggregating telemetry data through MCP tools.
    6
    MIT
  • A
    license
    -
    quality
    A
    maintenance
    An MCP server that gives AI agents observability over their own tool calls, enabling auditing, cost tracking, latency analysis, and alerting.
    MIT

View all related MCP servers

Related MCP Connectors

  • Agent Replay Debugger MCP — record every agent step + deterministic replay. Step-debugger for

  • Hosted MCP server for LLM cost estimation, model comparison, and budget-aware routing.

  • MCP server providing access to the Scorecard API to evaluate and optimize LLM systems.

View all MCP Connectors

Latest Blog Posts

MCP directory API

We provide all the information about MCP servers via our MCP API.

curl -X GET 'https://glama.ai/api/mcp/v1/servers/sohaibsohail98/mcp-context-inspector'

If you have feedback or need assistance with the MCP directory API, please join our Discord server