llmstxtgenerator-mcp
Officialllms.txt Generator MCP Server — Erstellen, Validieren & Prüfen von llms.txt (KI-Agenten-Werkzeuge)
llms.txt Generator verwandelt eine Website in eine kuratierte llms.txt — die Markdown-Datei, die KI-Systemen zeigt, welche Inhalte wirklich zählen. Dieser MCP-Server macht das für Agenten wie Claude, ChatGPT und Cursor verfügbar: eine Domain crawlen, einen Entwurf erzeugen, eine bestehende Datei validieren und sie gegen Googles neuen Lighthouse-Agentic Browsing-Audit prüfen. Kostenlos, ohne API-Key, ohne Registrierung.
Endpunkt:
https://www.llms-txt-generator.de/api/mcp(Streamable HTTP)MCP-Registry:
de.llms-txt-generator/llms-txt— veröffentlicht, Statusactivenpm-Brücke:
llmstxtgenerator-mcpWeb-App: llms-txt-generator.de
Format-Einführung: Was ist llms.txt? · FAQ
Unsere eigene Datei:
/llms.txt·/llms-full.txt
llms.txtist ein offener Vorschlag (llmstxt.org), kein ratifizierter Webstandard. Es ersetzt wederrobots.txtnochsitemap.xml, es ist keine Zugriffskontrolle und es garantiert weder Rankings noch KI-Zitate.
Status
Live. Der Endpunkt ist erreichbar und stellt alle vier Werkzeuge bereit:
curl -s https://www.llms-txt-generator.de/api/mcp \
-H 'Content-Type: application/json' \
-H 'Accept: application/json, text/event-stream' \
-d '{"jsonrpc":"2.0","id":1,"method":"tools/list"}'Derselbe deterministische Crawler, Generator und Validator, die auch die Web-App betreiben — keine separate Implementierung.
Warum llms.txt gerade jetzt wichtig ist
Seit Lighthouse 13.3 (August 2026) prüfen Google Lighthouse und PageSpeed Insights /llms.txt in einer Kategorie namens Agentic Browsing. Der Audit ist eine Strukturprüfung, kein Rankingfaktor der Google-Suche, und er ist bewusst minimal — drei Regeln:
Regel | Anforderung |
| Die Datei enthält eine H1-Überschrift ( |
| Mindestens ein echter Markdown-Link — Text in eckigen Klammern, URL in runden Klammern |
| Mehr als 50 Zeichen Inhalt |
Zwei Dinge überraschen die meisten:
Klartext-Links zählen nicht.
Homepage: https://example.comfällt durch den Audit, obwohl der Link funktioniert. Das ist der häufigste Grund, warum handgeschriebene Dateien scheitern.Gar keine Datei besteht. Eine fehlende
llms.txtwird als nicht zutreffend gemeldet; nur eine vorhandene, aber defekte fällt durch. Eine kaputt veröffentlichtellms.txtist schlechter als gar keine — genau deshalb gibt es dievalidate_*-Werkzeuge.
Wann dieser Server zum Einsatz kommt
Verwenden Sie ihn, wann immer ein Agent eine llms.txt erstellen, prüfen oder reparieren muss:
„Erzeuge eine llms.txt für example.com"
„Besteht unsere veröffentlichte llms.txt Googles Agentic-Browsing-Audit?"
„Prüfe diese llms.txt auf kaputte Links und Links zu fremden Domains"
„Warum beschwert sich PageSpeed Insights über unsere llms.txt?"
Nicht für: Crawl-Kontrolle (dafür ist robots.txt da), URL-Erkennung (dafür ist sitemap.xml da) oder SEO-Audits der gesamten Website.
Verbinden
Claude Code (eine Zeile):
claude mcp add --transport http llms-txt https://www.llms-txt-generator.de/api/mcpJeder Client mit einem mcpServers-Block (Cursor, Windsurf, VS Code, …):
{
"mcpServers": {
"llms-txt": {
"type": "streamable-http",
"url": "https://www.llms-txt-generator.de/api/mcp"
}
}
}Nur-stdio-Clients (z. B. Claude Desktop) über die npm-Brücke in diesem Repository:
{
"mcpServers": {
"llms-txt": {
"command": "npx",
"args": ["-y", "llmstxtgenerator-mcp"]
}
}
}ChatGPT / OpenAI: Der Server spricht einfaches Streamable HTTP, funktioniert also als Connector und innerhalb des Apps SDK — derselbe MCP-Standard, auf dem OpenAIs Plugins seit 2026 aufbauen.
Werkzeuge
Werkzeug | Funktion |
| Crawlt bis zu 15 öffentliche HTML-Seiten derselben registrierbaren Domain und liefert einen fertigen |
| Validiert |
| Ruft die live ausgelieferte |
| Prüft Text exakt gegen die drei Lighthouse- |
Typischer Ablauf: check_published_llms_txt → generate_llms_txt → validate_llms_txt → check_lighthouse_agentic_browsing.
Jede Antwort enthält einen note-Hinweis, der die Lighthouse-Regeln wiederholt, damit ein Agent, der über das Ergebnis nachdenkt, dieses README nicht gelesen haben muss.
Was der Crawler tut und nicht tut
Liest die Startseite,
robots.txt, Sitemaps und eine priorisierte Auswahl interner HTML-Seiten — maximal 15 Seiten, nur dieselbe registrierbare Domain.Extrahiert Titel, Beschreibungen, Überschriften, Canonical-URLs und JSON-LD-Typen deterministisch. Fehlende Fakten bleiben fehlend.
Blockiert: private Netzwerke, interne Hostnamen, fremde Redirect-Ziele, nicht standardmäßige Ports, URLs mit Zugangsdaten, Nicht-HTTP(S)-Schemata, übermäßig große Antworten.
Von der Ausgabe ausgeschlossen: Parameter-URLs,
noindex-Seiten, Duplikate, Fehlerantworten, Nicht-HTML-Dateitypen — jeweils mit Begründung.Der Schnell-Crawl führt kein Seiten-JavaScript aus. Nur clientseitig vorhandene Inhalte können fehlen.
FAQ
Was ist llms.txt?
Ein offener Vorschlag für eine Markdown-Datei unter /llms.txt, die Menschen und Maschinen einen kuratierten Überblick über eine Website gibt: eine H1 für den Namen, eine Blockquote-Zusammenfassung und H2-Abschnitte mit absoluten Links. Siehe llmstxt.org und unsere Einführung.
Verbessert llms.txt meine Google-Rankings?
Nein. Die Google-Suche ignoriert es als Ranking-Signal. Was sich 2026 geändert hat, ist, dass Google Lighthouse es nun auf Struktur prüft. Das sind verschiedene Dinge, und wer etwas anderes behauptet, übertreibt.
Brauche ich einen API-Key? Nein. Die Endpunkte sind öffentlich und pro IP ratenbegrenzt.
Ist ein Sprachmodell beteiligt? Nein. Der Crawler und der Generator sind vollständig deterministisch. Beschreibungen stammen nur aus den eigenen Metadaten oder dem sichtbaren Text der Quellseite.
Warum nur 15 Seiten?
Das hält den kostenlosen Dienst schnell und günstig im Betrieb, und eine gute llms.txt ist kuratiert statt erschöpfend. Größere Websites können sich gerne melden.
Wer betreibt das? track by track GmbH, Berlin — das Team hinter der Social-Media-Agentur famefact.
Wo ist die Datenschutzerklärung? Datenschutzerklärung · AGB.
Deutsch: llms.txt per KI-Agent erstellen, prüfen und reparieren
Der llms.txt Generator erzeugt aus einer
Website eine kuratierte llms.txt — die Markdown-Datei, die KI-Systemen zeigt,
welche Inhalte wirklich zählen. Dieser MCP-Server macht das für KI-Agenten
nutzbar: Domain crawlen, Entwurf erzeugen, bestehende Datei validieren und gegen
Googles neuen Lighthouse-Audit „Agentic Browsing" prüfen. Kostenlos, ohne
API-Key, ohne Registrierung.
Status: live. Endpunkt: https://www.llms-txt-generator.de/api/mcp
claude mcp add --transport http llms-txt https://www.llms-txt-generator.de/api/mcpWarum das gerade jetzt relevant ist
Seit Lighthouse 13.3 (August 2026) prüfen Google Lighthouse und PageSpeed
Insights in der Kategorie „Agentic Browsing" auch /llms.txt. Der Audit verlangt
drei Dinge: eine H1-Überschrift, mindestens einen echten Markdown-Link
(Linktext in eckigen, URL in runden Klammern) und mehr als 50 Zeichen Inhalt.
Zwei Punkte überraschen die meisten:
Klartext-Links zählen nicht.
Startseite: https://beispiel.defällt durch, obwohl der Link funktioniert. Das ist der häufigste Grund, warum von Hand geschriebene Dateien scheitern.Gar keine Datei besteht. Eine fehlende
llms.txtgilt als „nicht zutreffend"; nur eine vorhandene mit Fehlern fällt durch. Eine kaputt veröffentlichtellms.txtist schlechter als gar keine.
Der Audit ist eine Strukturprüfung, kein Rankingfaktor der Google-Suche.
Werkzeuge
Werkzeug | Funktion |
| Crawlt bis zu 15 öffentliche HTML-Seiten derselben registrierbaren Domain und liefert einen fertigen |
| Prüft H1, Zusammenfassung, Abschnitte, absolute Links, Duplikate, fremde Domains, Dateigröße und Aktualisierungsdatum. Liefert 0–100 Punkte plus Befunde mit Schweregrad und Zeilennummer. |
| Ruft die live ausgelieferte |
| Prüft Text exakt gegen die drei Lighthouse-Regeln und benennt, welche davon fehlschlägt. |
Sicherheit des Crawls
Blockiert werden private Netzwerke, interne Hostnamen, fremde Redirect-Ziele,
nicht standardmäßige Ports, URLs mit Zugangsdaten und Nicht-HTTP(S)-Schemata.
Ausgeschlossen werden Parameter-URLs, noindex-Seiten, Duplikate und
Fehlerantworten — jeweils mit Begründung. Der Schnell-Crawl führt kein
Seiten-JavaScript aus.
Nützliche Links
Generator: llms-txt-generator.de
Format erklärt: Was ist llms.txt?
Häufige Fragen: FAQ
Blog zu GEO und llms.txt: Blog
Größere Website? Termin anfragen
Dieses Repository enthält Dokumentation, Discovery-Metadaten (server.json) und die npm-stdio-Brücke. Der Server selbst wird von der track by track GmbH, Berlin (Impressum) betrieben.
Lizenz: MIT — siehe LICENSE.
This server cannot be installed
Maintenance
Resources
Unclaimed servers have limited discoverability.
Looking for Admin?
If you are the server author, to access and configure the admin panel.
Related MCP Connectors
Generate 18 AI readiness files (llms.txt, ai.txt, RAG indexes, schema) for any website.
Scan any URL for AI agent readability — Vercel Spec, llmstxt.org, and agent-protocol manifests.
SEO research, audits, backlinks, GSC, and content workflow tools for AI agents.
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/llms-txt-generator/llmstxtgenerator-mcp'
If you have feedback or need assistance with the MCP directory API, please join our Discord server