MCP Windows Website Downloader Server
Descargador de sitios web de MCP
Servidor MCP simple para descargar sitios web de documentación y prepararlos para la indexación RAG.
Características
Descarga sitios de documentación completos, bueno, grandes porciones de todos modos.
Mantiene la estructura del enlace y la navegación, en realidad no. jajaja
Descarga y organiza activos (CSS, JS, imágenes), pero no es realmente compatible con IA y probablemente todo necesite algún tipo de análisis o vectorización en una base de datos o algo así.
Crea un índice limpio para sistemas RAG, actualmente parece crear un índice en cada carpeta, ni siquiera lo he mirado.
Interfaz MCP simple y de un solo propósito, sí.
Related MCP server: Skrape MCP Server
Instalación
Bifurcar y descargar, cd al repositorio.
uv venv
./venv/Scripts/activate
pip install -e .Coloque esto en su claude_desktop_config.json con sus propias rutas:
"mcp-windows-website-downloader": {
"command": "uv",
"args": [
"--directory",
"F:/GithubRepos/mcp-windows-website-downloader",
"run",
"mcp-windows-website-downloader",
"--library",
"F:/GithubRepos/mcp-windows-website-downloader/website_library"
]
},
Otros usos por los que no tienes que preocuparte y que pueden resultar alucinantes, jajaja:
Iniciar el servidor:
python -m mcp_windows_website_downloader.server --library docs_libraryÚselo a través de Claude Desktop u otros clientes MCP:
result = await server.call_tool("download", {
"url": "https://docs.example.com"
})Estructura de salida
docs_library/
domain_name/
index.html
about.html
docs/
getting-started.html
...
assets/
css/
js/
images/
fonts/
rag_index.jsonDesarrollo
El servidor sigue la arquitectura MCP estándar:
src/
mcp_windows_website_downloader/
__init__.py
server.py # MCP server implementation
core.py # Core downloader functionality
utils.py # Helper utilitiesComponentes
server.py: Implementación del servidor MCP principal que maneja el registro y las solicitudes de herramientascore.py: Funcionalidad de descarga del sitio web principal con manejo adecuado de activosutils.py: utilidades auxiliares para el manejo de archivos y el procesamiento de URL
Principios de diseño
Responsabilidad única
Cada módulo tiene un propósito claro
El servidor maneja la interfaz MCP
El núcleo gestiona la descarga
Utils maneja operaciones comunes
Estructura limpia
Mantiene la estructura original del sitio.
Organiza los activos por tipo
Crea un índice claro para los sistemas RAG
Operación robusta
Manejo adecuado de errores
Límites de profundidad razonables
Verificación de descarga de activos
Procesamiento limpio de URL/ruta
Índice RAG
El archivo rag_index.json contiene:
{
"url": "https://docs.example.com",
"domain": "docs.example.com",
"pages": 42,
"path": "/path/to/site"
}Contribuyendo
Bifurcar el repositorio
Crear una rama de características
Realiza tus cambios
Enviar una solicitud de extracción
Licencia
Licencia MIT - Ver archivo LICENCIA
Manejo de errores
El servidor gestiona problemas comunes:
URL no válidas
Errores de red
Errores en la descarga de activos
HTML mal formado
Recursión profunda
Errores del sistema de archivos
Las respuestas de error siguen el formato:
{
"status": "error",
"error": "Detailed error message"
}Respuestas de éxito:
{
"status": "success",
"path": "/path/to/downloaded/site",
"pages": 42
}Maintenance
Resources
Unclaimed servers have limited discoverability.
Looking for Admin?
If you are the server author, to access and configure the admin panel.
Tools
Related MCP Servers
- FlicenseBqualityDmaintenanceProvides a tool to download entire websites using wget. It preserves the website structure and converts links to work locally.1156

Skrape MCP Serverofficial
AlicenseBqualityDmaintenanceThis server converts webpages into clean, structured Markdown optimized for language model consumption, removing unnecessary content and supporting JavaScript rendering.112MIT- AlicenseNot gradedqualityCmaintenanceEnables AI agents to clone entire websites, download files, manage authentication sessions, and analyze site information with support for JavaScript-heavy SPAs and dynamic content.8Apache 2.0
- FlicenseNot gradedqualityDmaintenanceA locally-hosted MCP server that provides AI assistants with advanced web crawling capabilities, including structured data extraction, deep site crawling, and page screenshots. It enables users to convert single or multiple URLs into clean Markdown content for processing by LLMs without requiring external API keys for basic features.
Related MCP Connectors
Scrape, crawl, map & search the web. Open-source, self-hostable Rust crawler & search for AI agents.
Free remote MCP server for fetching public web pages through a rotating proxy pool.
Host static HTML pages, generate PDFs, screenshots, scrape JS sites, run sandboxed JavaScript.
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/angrysky56/mcp-windows-website-downloader'
If you have feedback or need assistance with the MCP directory API, please join our Discord server