Skip to main content
Glama

VidWords YouTube MCP Server

Un servidor alojado de Model Context Protocol que permite a un agente de IA leer vídeos de YouTube — y citar el segundo exacto del que obtuvo la respuesta.

MCP Registry Docs

Un modelo de lenguaje no puede ver un vídeo. Apúntalo a este endpoint y obtiene nueve herramientas para buscar transcripciones, leer los fotogramas de un vídeo — diapositivas, gráficos, demos, texto en pantalla — y responder preguntas con citas que se verifican antes de que las veas.

Sin código de integración. Sin scraping. Sin grupo de proxies.

POST https://vidwords.com/mcp
Authorization: Basic <your-api-token>

Solo remoto y alojado: no hay nada que instalar ni autoalojar. Este repositorio es el manifiesto público, la referencia de configuración y el rastreador de incidencias para ese endpoint.


Inicio rápido

Obtén un token gratuito: crea una cuenta en vidwords.com/register, verifica tu correo electrónico y luego copia el token de tu perfil. El plan gratuito incluye créditos mensuales y 10 minutos de Watch, así que puedes configurarlo y usarlo antes de pagar nada.

Claude Code

claude mcp add --transport http vidwords https://vidwords.com/mcp \
  --header "Authorization: Basic YOUR_API_TOKEN"

Claude Desktop — claude_desktop_config.json

{
  "mcpServers": {
    "vidwords": {
      "type": "http",
      "url": "https://vidwords.com/mcp",
      "headers": { "Authorization": "Basic YOUR_API_TOKEN" }
    }
  }
}

Cursor — .cursor/mcp.json

{
  "mcpServers": {
    "vidwords": {
      "url": "https://vidwords.com/mcp",
      "headers": { "Authorization": "Basic YOUR_API_TOKEN" }
    }
  }
}

Codex CLI — ~/.codex/config.toml

[mcp_servers.vidwords]
url = "https://vidwords.com/mcp"
env_http_headers = { "Authorization" = "VIDWORDS_MCP_AUTH" }
export VIDWORDS_MCP_AUTH="Basic YOUR_API_TOKEN"

No uses bearer_token_env_var. Es el campo que parece obvio, pero envía Authorization: Bearer <valor> y este servidor autentica con Basic.

claude.ai y ChatGPT — OAuth, nada que pegar

Añade https://vidwords.com/mcp como conector personalizado. El host se registra solo, te envía a VidWords para iniciar sesión y muestra una pantalla de consentimiento que nombra exactamente lo que pide. El registro por sí solo no concede nada: el acceso comienza solo cuando una persona con sesión iniciada hace clic en Aprobar, y las conexiones activas se pueden revocar desde tu página de API con efecto inmediato.

Clientes sin soporte de cabeceras personalizadas, y Docker

Este repositorio también incluye un pequeño proxy stdio (src/index.js) que habla MCP por stdin/stdout y reenvía las llamadas de herramientas al endpoint alojado. Úsalo cuando tu cliente no pueda enviar una cabecera HTTP personalizada, o cuando quieras el servidor en un contenedor:

{
  "mcpServers": {
    "vidwords": {
      "command": "npx",
      "args": ["-y", "github:haljishi/vidwords-mcp"],
      "env": { "VIDWORDS_API_TOKEN": "YOUR_API_TOKEN" }
    }
  }
}

Ejecuta directamente desde este repositorio: el proxy no está publicado en npm, así que un simple npx @vidwords/mcp no se resolverá.

docker build -t vidwords-mcp .
docker run --rm -i -e VIDWORDS_API_TOKEN=YOUR_API_TOKEN vidwords-mcp

Los esquemas de las herramientas se declaran en línea en el proxy, por lo que initialize y tools/list responden sin credenciales y no se contacta con el upstream hasta que se llama realmente a una herramienta. Una llamada sin VIDWORDS_API_TOKEN devuelve un error legible en lugar de fallar el handshake. VIDWORDS_MCP_URL anula el endpoint si apuntas a una instancia que no es de producción.

El puente genérico mcp-remote también funciona:

{
  "mcpServers": {
    "vidwords": {
      "command": "npx",
      "args": ["-y", "mcp-remote", "https://vidwords.com/mcp",
               "--header", "Authorization:Basic YOUR_API_TOKEN"]
    }
  }
}

Los archivos de configuración listos están en examples/.


Related MCP server: YouTube Transcript MCP Server

Las nueve herramientas

Herramienta

Qué hace

Costo

search_transcript

Encuentra dónde un vídeo discute algo. Devuelve los momentos coincidentes con marcas de tiempo, contexto citado y enlaces profundos youtube.com/watch?v=…&t=…s.

1 crédito

get_transcript

Texto completo de la transcripción para hasta 25 vídeos en una sola llamada.

1 crédito por vídeo

list_channel_videos

Resuelve un identificador de canal, URL o id UC… a sus subidas recientes.

Gratis · Starter y superior

list_watchlists

Las listas de seguimiento Radar de la cuenta y cuánto ha registrado cada una.

Gratis

watchlist_activity

Subidas más recientes que Radar ha registrado para una lista de seguimiento.

Gratis

account

Plan y créditos restantes, para que el agente pueda calcular el costo de un trabajo antes de ejecutarlo.

Gratis

analyze_video

Inicia un análisis a nivel de fotograma: diapositivas, gráficos, demos y texto en pantalla, no solo subtítulos. Devuelve un analysisId inmediatamente.

Minutos de Watch

get_analysis

Lee un análisis terminado: capítulos, puntos clave, evidencia con marca de tiempo.

Gratis

ask_video

Haz una pregunta sobre un análisis terminado. Las citas se verifican contra la evidencia almacenada o se descartan.

1 pregunta de Watch

Prefiere search_transcript sobre get_transcript

Ambos cuestan un crédito por vídeo, así que no hay razón de facturación para elegir. La razón es el contexto. Pregunta "¿qué dijo esta entrevista de dos horas sobre precios?" y get_transcript devuelve aproximadamente 20,000 palabras, de las cuales quizás 300 son sobre precios — esas 300 ahora compiten por atención con 19,700 que no lo son, y la respuesta empeora, se vuelve más lenta y más cara de generar.

search_transcript devuelve solo los tramos coincidentes, cada uno con un enlace profundo. Recurre a get_transcript cuando realmente quieras el texto completo: una exportación, un diff, un corpus.

Lee la imagen, no solo los subtítulos

analyze_video examina diapositivas, gráficos, ejemplos de código y texto en pantalla que nunca se dice en voz alta. ask_video luego responde basándose en ese análisis almacenado, y cada cita se verifica antes de que la veas: una afirmación visual tiene que coincidir con un fotograma que realmente se grabó, una afirmación hablada tiene que aterrizar en un segmento real de transcripción. Cualquier cosa que falle se descarta, y cuando nada sobrevive, la respuesta dice que la evidencia es insuficiente en lugar de producir una suposición segura.

Eso es ocasionalmente molesto — una negativa es una demostración peor que una respuesta fluida — y es la única versión de esta función que es segura de poner frente a un agente, porque un agente repite lo que se le dice sin el escepticismo que aplica un lector humano.


Autenticación, costos y límites

  • Basic, no Bearer. El token se envía tal cual; no codificas en base64 un par usuario:contraseña.

  • Verifica tu correo primero. Hasta que hagas clic en el enlace de verificación, cada llamada devuelve 403 con {"error":"email_unverified"} — el fallo más común en la primera llamada de una cuenta nueva.

  • Los créditos son un solo grupo compartido con la API REST y el sitio web. Un crédito es una transcripción. El análisis de fotogramas consume minutos de Watch en su lugar, y una ejecución rechazada antes de comenzar no cuesta nada.

  • Límite de velocidad: 30 solicitudes / 10s — deliberadamente más flexible que el 5 de la API REST, porque el servidor es sin estado y un cliente vuelve a ejecutar initialize antes de cada llamada. analyze_video tiene su propio límite de 10 inicios por minuto, compartido con la ruta REST.

  • Los tokens de RapidAPI se rechazan aquí. Esa identidad se mide por llamada y no tiene cuenta detrás, y ninguna de las dos cosas sobrevive a una sesión de llamada de herramientas. Usa un token de API de VidWords.

  • Sin estado por diseño. Sin flujos SSE reanudables, sin sesión que eliminar; cada herramienta responde en una sola vez. GET y DELETE devuelven un error JSON-RPC en lugar de un 404 HTML.

  • Los subtítulos tienen que existir. Para un vídeo sin pista de subtítulos, una cuenta con sesión iniciada puede transcribir desde el audio en su lugar — con precio por duración, cotizado antes de que gastes.

Números completos: precios.


Documentación

Soporte

Abre una incidencia aquí para cualquier cosa sobre la superficie MCP: una herramienta que se comporta mal, un cliente cuya configuración no hemos documentado, un esquema que podría ser más claro. Las preguntas de cuenta y facturación van a soporte.

Licencia

El contenido de este repositorio (documentación y ejemplos de configuración) tiene licencia MIT. El servicio alojado en sí es propietario y se rige por los términos de VidWords.


Producto independiente; no afiliado con YouTube o Google.

Install Server
A
license - permissive license
A
quality
C
maintenance

Maintenance

Maintainers
Response time
Release cycle
Releases (12mo)
Commit activity

Related MCP Servers

  • A
    license
    B
    quality
    D
    maintenance
    Transforms YouTube into a queryable knowledge source with search, video details, transcript analysis, and AI-powered tools for summaries, learning paths, and knowledge graphs. Features quota-aware API access with caching and optional OpenAI/Anthropic integration for advanced content analysis.
    10
    590
    1
    MIT
  • F
    license
    -
    quality
    D
    maintenance
    Builds a searchable knowledge base from YouTube video transcripts with hybrid semantic and keyword search. Allows LLM assistants to search, organize, and retrieve timestamped information from videos you've watched.
    3
  • A
    license
    -
    quality
    D
    maintenance
    Enables AI assistants to watch YouTube videos by extracting frames at scene changes and visual references, pairing each frame with the exact words spoken at that timestamp. Provides dense frame-transcript interleaving for any model.
    14
    2
    MIT

View all related MCP servers

Related MCP Connectors

View all MCP Connectors

Latest Blog Posts

MCP directory API

We provide all the information about MCP servers via our MCP API.

curl -X GET 'https://glama.ai/api/mcp/v1/servers/haljishi/vidwords-mcp'

If you have feedback or need assistance with the MCP directory API, please join our Discord server