MCP Windows Website Downloader Server
MCP Website Downloader
Einfacher MCP-Server zum Herunterladen von Dokumentationswebsites und Vorbereiten für die RAG-Indizierung.
Merkmale
Lädt komplette Dokumentationsseiten herunter, zumindest große Teile.
Behält die Linkstruktur und Navigation bei, nicht wirklich. lol
Lädt Assets (CSS, JS, Bilder) herunter und organisiert sie, ist aber nicht wirklich KI-freundlich und es muss wahrscheinlich alles irgendwie analysiert oder in eine Datenbank oder so etwas vektorisiert werden.
Erstellt einen sauberen Index für RAG-Systeme. Derzeit scheint in jedem Ordner ein Index erstellt zu werden, ohne dass er noch einmal angeschaut wurde.
Einfache, zweckgebundene MCP-Schnittstelle, ja.
Related MCP server: Skrape MCP Server
Installation
Forken und herunterladen, mit CD zum Repository wechseln.
uv venv
./venv/Scripts/activate
pip install -e .Fügen Sie dies mit Ihren eigenen Pfaden in Ihre claude_desktop_config.json ein:
"mcp-windows-website-downloader": {
"command": "uv",
"args": [
"--directory",
"F:/GithubRepos/mcp-windows-website-downloader",
"run",
"mcp-windows-website-downloader",
"--library",
"F:/GithubRepos/mcp-windows-website-downloader/website_library"
]
},
Andere Verwendungen, über die Sie sich keine Sorgen machen müssen und die halluzinogene Wirkungen haben können, lol:
Starten Sie den Server:
python -m mcp_windows_website_downloader.server --library docs_libraryVerwendung über Claude Desktop oder andere MCP-Clients:
result = await server.call_tool("download", {
"url": "https://docs.example.com"
})Ausgabestruktur
docs_library/
domain_name/
index.html
about.html
docs/
getting-started.html
...
assets/
css/
js/
images/
fonts/
rag_index.jsonEntwicklung
Der Server folgt der Standard-MCP-Architektur:
src/
mcp_windows_website_downloader/
__init__.py
server.py # MCP server implementation
core.py # Core downloader functionality
utils.py # Helper utilitiesKomponenten
server.py: Hauptimplementierung des MCP-Servers, die die Tool-Registrierung und -Anfragen verarbeitetcore.py: Kernfunktion zum Herunterladen von Websites mit ordnungsgemäßer Asset-Verarbeitungutils.py: Hilfsprogramme für die Dateiverwaltung und URL-Verarbeitung
Designprinzipien
Einzelverantwortung
Jedes Modul hat einen klaren Zweck
Server verarbeitet MCP-Schnittstelle
Der Kern übernimmt das Herunterladen
Utils übernimmt allgemeine Operationen
Saubere Struktur
Behält die ursprüngliche Site-Struktur bei
Organisiert Vermögenswerte nach Typ
Schafft einen übersichtlichen Index für RAG-Systeme
Robuster Betrieb
Richtige Fehlerbehandlung
Angemessene Tiefengrenzen
Überprüfung des Asset-Downloads
Saubere URL-/Pfadverarbeitung
RAG-Index
Die Datei rag_index.json enthält:
{
"url": "https://docs.example.com",
"domain": "docs.example.com",
"pages": 42,
"path": "/path/to/site"
}Beitragen
Forken Sie das Repository
Erstellen eines Feature-Zweigs
Nehmen Sie Ihre Änderungen vor
Senden einer Pull-Anfrage
Lizenz
MIT-Lizenz – Siehe LICENSE-Datei
Fehlerbehandlung
Der Server behandelt allgemeine Probleme:
Ungültige URLs
Netzwerkfehler
Fehler beim Herunterladen von Assets
Fehlerhaftes HTML
Tiefe Rekursion
Dateisystemfehler
Fehlerantworten folgen dem Format:
{
"status": "error",
"error": "Detailed error message"
}Erfolgsantworten:
{
"status": "success",
"path": "/path/to/downloaded/site",
"pages": 42
}Maintenance
Resources
Unclaimed servers have limited discoverability.
Looking for Admin?
If you are the server author, to access and configure the admin panel.
Tools
Related MCP Servers
- FlicenseBqualityDmaintenanceProvides a tool to download entire websites using wget. It preserves the website structure and converts links to work locally.1156

Skrape MCP Serverofficial
AlicenseBqualityDmaintenanceThis server converts webpages into clean, structured Markdown optimized for language model consumption, removing unnecessary content and supporting JavaScript rendering.112MIT- AlicenseNot gradedqualityCmaintenanceEnables AI agents to clone entire websites, download files, manage authentication sessions, and analyze site information with support for JavaScript-heavy SPAs and dynamic content.8Apache 2.0
- FlicenseNot gradedqualityDmaintenanceA locally-hosted MCP server that provides AI assistants with advanced web crawling capabilities, including structured data extraction, deep site crawling, and page screenshots. It enables users to convert single or multiple URLs into clean Markdown content for processing by LLMs without requiring external API keys for basic features.
Related MCP Connectors
Scrape, crawl, map & search the web. Open-source, self-hostable Rust crawler & search for AI agents.
Free remote MCP server for fetching public web pages through a rotating proxy pool.
Host static HTML pages, generate PDFs, screenshots, scrape JS sites, run sandboxed JavaScript.
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/angrysky56/mcp-windows-website-downloader'
If you have feedback or need assistance with the MCP directory API, please join our Discord server