Skip to main content
Glama

VidWords YouTube MCP Server

Ein gehosteter Model Context Protocol-Server, der es einem KI-Agenten ermöglicht, YouTube-Videos zu lesen – und die genaue Sekunde zu zitieren, in der er die Antwort gefunden hat.

MCP Registry Docs

Ein Sprachmodell kann kein Video ansehen. Wenn Sie es auf diesen Endpunkt verweisen, erhält es neun Werkzeuge zum Durchsuchen von Transkripten, zum Lesen der Frames eines Videos – Folien, Diagramme, Demos, Bildschirmtext – und zum Beantworten von Fragen mit Zitaten, die überprüft werden, bevor Sie sie sehen.

Kein Integrationscode. Kein Scraping. Kein Proxy-Pool.

POST https://vidwords.com/mcp
Authorization: Basic <your-api-token>

Nur remote und gehostet – es gibt nichts zu installieren oder selbst zu hosten. Dieses Repository ist das öffentliche Manifest, die Konfigurationsreferenz und das Issue-Tracking für diesen Endpunkt.


Schnellstart

Holen Sie sich ein kostenloses Token: Erstellen Sie ein Konto unter vidwords.com/register, bestätigen Sie Ihre E-Mail-Adresse und kopieren Sie dann das Token aus Ihrem Profil. Der kostenlose Plan enthält monatliche Guthaben und 10 Watch-Minuten, sodass Sie dies einrichten und nutzen können, bevor Sie etwas bezahlen.

Claude Code

claude mcp add --transport http vidwords https://vidwords.com/mcp \
  --header "Authorization: Basic YOUR_API_TOKEN"

Claude Desktop – claude_desktop_config.json

{
  "mcpServers": {
    "vidwords": {
      "type": "http",
      "url": "https://vidwords.com/mcp",
      "headers": { "Authorization": "Basic YOUR_API_TOKEN" }
    }
  }
}

Cursor – .cursor/mcp.json

{
  "mcpServers": {
    "vidwords": {
      "url": "https://vidwords.com/mcp",
      "headers": { "Authorization": "Basic YOUR_API_TOKEN" }
    }
  }
}

Codex CLI – ~/.codex/config.toml

[mcp_servers.vidwords]
url = "https://vidwords.com/mcp"
env_http_headers = { "Authorization" = "VIDWORDS_MCP_AUTH" }
export VIDWORDS_MCP_AUTH="Basic YOUR_API_TOKEN"

Verwenden Sie nicht bearer_token_env_var. Es ist das naheliegend aussehende Feld, aber es sendet Authorization: Bearer <value> und dieser Server authentifiziert mit Basic.

claude.ai und ChatGPT – OAuth, nichts zum Einfügen

Fügen Sie https://vidwords.com/mcp als benutzerdefinierten Connector hinzu. Der Host registriert sich selbst, leitet Sie zur Anmeldung an VidWords weiter und zeigt einen Zustimmungsbildschirm an, der genau benennt, worum es bittet. Die Registrierung allein gewährt nichts – der Zugriff beginnt erst, wenn eine angemeldete Person auf Approve klickt, und aktive Verbindungen können jederzeit über Ihre API-Seite mit sofortiger Wirkung widerrufen werden.

Clients ohne Unterstützung für benutzerdefinierte Header und Docker

Dieses Repository enthält außerdem einen kleinen stdio-Proxy (src/index.js), der MCP auf stdin/stdout spricht und Tool-Aufrufe an den gehosteten Endpunkt weiterleitet. Verwenden Sie ihn, wenn Ihr Client keinen benutzerdefinierten HTTP-Header senden kann oder wenn Sie den Server in einem Container betreiben möchten:

{
  "mcpServers": {
    "vidwords": {
      "command": "npx",
      "args": ["-y", "github:haljishi/vidwords-mcp"],
      "env": { "VIDWORDS_API_TOKEN": "YOUR_API_TOKEN" }
    }
  }
}

Direkt aus diesem Repository ausführen – der Proxy ist nicht auf npm veröffentlicht, daher schlägt ein nacktes npx @vidwords/mcp fehl.

docker build -t vidwords-mcp .
docker run --rm -i -e VIDWORDS_API_TOKEN=YOUR_API_TOKEN vidwords-mcp

Die Tool-Schemas sind inline im Proxy deklariert, sodass initialize und tools/list ohne Anmeldeinformationen antworten und der Upstream erst kontaktiert wird, wenn ein Tool tatsächlich aufgerufen wird. Ein Aufruf ohne VIDWORDS_API_TOKEN gibt einen lesbaren Fehler zurück, anstatt den Handshake fehlschlagen zu lassen. VIDWORDS_MCP_URL überschreibt den Endpunkt, wenn Sie auf eine Nicht-Produktionsinstanz zeigen.

Die generische mcp-remote-Brücke funktioniert ebenfalls:

{
  "mcpServers": {
    "vidwords": {
      "command": "npx",
      "args": ["-y", "mcp-remote", "https://vidwords.com/mcp",
               "--header", "Authorization:Basic YOUR_API_TOKEN"]
    }
  }
}

Fertige Konfigurationsdateien finden Sie in examples/.


Related MCP server: YouTube Transcript MCP Server

Die neun Werkzeuge

Tool

Was es tut

Kosten

search_transcript

Finden Sie heraus, wo ein Video etwas bespricht. Gibt die passenden Momente mit Zeitstempeln, zitiertem Kontext und youtube.com/watch?v=…&t=…s-Deep-Links zurück.

1 Guthaben

get_transcript

Vollständiger Transkripttext für bis zu 25 Videos in einem Aufruf.

1 Guthaben pro Video

list_channel_videos

Lösen Sie eine Kanal-Handle, URL oder UC…-ID zu den letzten Uploads auf.

Kostenlos · Starter und höher

list_watchlists

Die Radar-Watchlists des Kontos und wie viel jede aufgezeichnet hat.

Kostenlos

watchlist_activity

Neueste Uploads, die Radar für eine Watchlist aufgezeichnet hat.

Kostenlos

account

Plan und verbleibendes Guthaben, damit der Agent einen Auftrag vor der Ausführung kalkulieren kann.

Kostenlos

analyze_video

Starten Sie eine Frame-basierte Analyse – Folien, Diagramme, Demos und Bildschirmtext, nicht nur Untertitel. Gibt sofort eine analysisId zurück.

Watch-Minuten

get_analysis

Lesen Sie eine abgeschlossene Analyse: Kapitel, Kernpunkte, mit Zeitstempel versehene Belege.

Kostenlos

ask_video

Stellen Sie eine Frage zu einer abgeschlossenen Analyse. Zitate werden anhand gespeicherter Belege verifiziert oder verworfen.

1 Watch-Frage

Bevorzugen Sie search_transcript gegenüber get_transcript

Beide kosten ein Guthaben pro Video, es gibt also keinen abrechnungstechnischen Grund für die Wahl. Der Grund ist der Kontext. Fragen Sie: „Was hat dieses zweistündige Interview über die Preisgestaltung gesagt?“ und get_transcript liefert etwa 20.000 Wörter, von denen vielleicht 300 sich mit der Preisgestaltung befassen – diese 300 konkurrieren nun mit 19.700 anderen um Aufmerksamkeit, und die Antwort wird schlechter, langsamer und teurer zu generieren.

search_transcript gibt nur die passenden Abschnitte zurück, jeweils mit einem Deep-Link. Greifen Sie zu get_transcript, wenn Sie wirklich den gesamten Text möchten: für einen Export, einen Diff, ein Korpus.

Es liest das Bild, nicht nur die Untertitel

analyze_video betrachtet Folien, Diagramme, Codebeispiele und Bildschirmtext, der nie laut ausgesprochen wird. ask_video antwortet dann anhand dieser gespeicherten Analyse, und jedes Zitat wird überprüft, bevor Sie es sehen: Eine visuelle Behauptung muss zu einem Frame passen, der tatsächlich aufgezeichnet wurde, eine gesprochene Behauptung muss auf einem echten Transkriptsegment landen. Alles, was fehlschlägt, wird verworfen, und wenn nichts übrig bleibt, sagt die Antwort, dass die Beweise nicht ausreichen, anstatt eine selbstbewusste Vermutung zu äußern.

Das ist gelegentlich nervig – eine Verweigerung ist eine schlechtere Demo als eine flüssige Antwort – und es ist die einzige Version dieser Funktion, die sicher vor einen Agenten gesetzt werden kann, denn ein Agent wiederholt, was ihm gesagt wird, ohne die Skepsis, die ein menschlicher Leser anwendet.


Authentifizierung, Kosten und Limits

  • Basic, nicht Bearer. Das Token wird unverändert gesendet; Sie codieren kein user:pass-Paar in Base64.

  • Bestätigen Sie zuerst Ihre E-Mail-Adresse. Bis Sie auf den Bestätigungslink klicken, gibt jeder Aufruf 403 mit {"error":"email_unverified"} zurück – der häufigste Fehler beim ersten Aufruf eines neuen Kontos.

  • Guthaben ist ein gemeinsamer Pool, der mit der REST-API und der Website geteilt wird. Ein Guthaben entspricht einem Transkript. Die Frame-Analyse verbraucht stattdessen Watch-Minuten, und ein Lauf, der vor dem Start abgelehnt wird, kostet nichts.

  • Ratenlimit: 30 Anfragen / 10 s – bewusst großzügiger als die 5 der REST-API, da der Server zustandslos ist und ein Client initialize vor jedem Aufruf erneut ausführt. analyze_video hat eine eigene Obergrenze von 10 Starts pro Minute, die mit der REST-Route geteilt wird.

  • RapidAPI-Tokens werden hier abgelehnt. Diese Identität wird pro Aufruf abgerechnet und hat kein Konto dahinter, was beides eine Tool-Calling-Sitzung nicht übersteht. Verwenden Sie ein VidWords-API-Token.

  • Von Natur aus zustandslos. Keine fortsetzbaren SSE-Streams, keine Sitzung zum Löschen; jedes Tool antwortet in einem Durchgang. GET und DELETE geben einen JSON-RPC-Fehler zurück, keinen HTML-404.

  • Untertitel müssen vorhanden sein. Für ein Video ohne Untertitelspur kann ein angemeldetes Konto stattdessen eine Transkription aus dem Audio erstellen – preislich nach Länge, vorab kalkuliert, bevor Sie ausgeben.

Vollständige Zahlen: Preise.


Dokumentation

Support

Eröffnen Sie hier ein Issue für alles, was die MCP-Oberfläche betrifft – ein Tool, das sich falsch verhält, einen Client, dessen Konfiguration wir nicht dokumentiert haben, ein Schema, das klarer sein könnte. Fragen zu Konto und Abrechnung richten Sie bitte an den Support.

Lizenz

Der Inhalt dieses Repositorys (Dokumentation und Konfigurationsbeispiele) ist unter der MIT-Lizenz lizenziert. Der gehostete Dienst selbst ist proprietär und unterliegt den VidWords-Bedingungen.


Unabhängiges Produkt; nicht mit YouTube oder Google verbunden.

Install Server
A
license - permissive license
A
quality
C
maintenance

Maintenance

Maintainers
Response time
Release cycle
Releases (12mo)
Commit activity

Related MCP Servers

  • A
    license
    B
    quality
    D
    maintenance
    Transforms YouTube into a queryable knowledge source with search, video details, transcript analysis, and AI-powered tools for summaries, learning paths, and knowledge graphs. Features quota-aware API access with caching and optional OpenAI/Anthropic integration for advanced content analysis.
    10
    590
    1
    MIT
  • F
    license
    -
    quality
    D
    maintenance
    Builds a searchable knowledge base from YouTube video transcripts with hybrid semantic and keyword search. Allows LLM assistants to search, organize, and retrieve timestamped information from videos you've watched.
    3
  • A
    license
    -
    quality
    D
    maintenance
    Enables AI assistants to watch YouTube videos by extracting frames at scene changes and visual references, pairing each frame with the exact words spoken at that timestamp. Provides dense frame-transcript interleaving for any model.
    14
    2
    MIT

View all related MCP servers

Related MCP Connectors

View all MCP Connectors

Latest Blog Posts

MCP directory API

We provide all the information about MCP servers via our MCP API.

curl -X GET 'https://glama.ai/api/mcp/v1/servers/haljishi/vidwords-mcp'

If you have feedback or need assistance with the MCP directory API, please join our Discord server