Skip to main content
Glama
llms-txt-generator

llmstxtgenerator-mcp

Official

llms.txt Generator MCP Server — Erstellen, Validieren & Prüfen von llms.txt (KI-Agenten-Werkzeuge)

MCP Registry Transport Lighthouse Status Lizenz: MIT

llms.txt Generator verwandelt eine Website in eine kuratierte llms.txt — die Markdown-Datei, die KI-Systemen zeigt, welche Inhalte wirklich zählen. Dieser MCP-Server macht das für Agenten wie Claude, ChatGPT und Cursor verfügbar: eine Domain crawlen, einen Entwurf erzeugen, eine bestehende Datei validieren und sie gegen Googles neuen Lighthouse-Agentic Browsing-Audit prüfen. Kostenlos, ohne API-Key, ohne Registrierung.

llms.txt ist ein offener Vorschlag (llmstxt.org), kein ratifizierter Webstandard. Es ersetzt weder robots.txt noch sitemap.xml, es ist keine Zugriffskontrolle und es garantiert weder Rankings noch KI-Zitate.

Status

Live. Der Endpunkt ist erreichbar und stellt alle vier Werkzeuge bereit:

curl -s https://www.llms-txt-generator.de/api/mcp \
  -H 'Content-Type: application/json' \
  -H 'Accept: application/json, text/event-stream' \
  -d '{"jsonrpc":"2.0","id":1,"method":"tools/list"}'

Derselbe deterministische Crawler, Generator und Validator, die auch die Web-App betreiben — keine separate Implementierung.

Warum llms.txt gerade jetzt wichtig ist

Seit Lighthouse 13.3 (August 2026) prüfen Google Lighthouse und PageSpeed Insights /llms.txt in einer Kategorie namens Agentic Browsing. Der Audit ist eine Strukturprüfung, kein Rankingfaktor der Google-Suche, und er ist bewusst minimal — drei Regeln:

Regel

Anforderung

hasH1

Die Datei enthält eine H1-Überschrift (# Site name)

hasLink

Mindestens ein echter Markdown-Link — Text in eckigen Klammern, URL in runden Klammern

isTooShort

Mehr als 50 Zeichen Inhalt

Zwei Dinge überraschen die meisten:

  1. Klartext-Links zählen nicht. Homepage: https://example.com fällt durch den Audit, obwohl der Link funktioniert. Das ist der häufigste Grund, warum handgeschriebene Dateien scheitern.

  2. Gar keine Datei besteht. Eine fehlende llms.txt wird als nicht zutreffend gemeldet; nur eine vorhandene, aber defekte fällt durch. Eine kaputt veröffentlichte llms.txt ist schlechter als gar keine — genau deshalb gibt es die validate_*-Werkzeuge.

Wann dieser Server zum Einsatz kommt

Verwenden Sie ihn, wann immer ein Agent eine llms.txt erstellen, prüfen oder reparieren muss:

  • „Erzeuge eine llms.txt für example.com"

  • „Besteht unsere veröffentlichte llms.txt Googles Agentic-Browsing-Audit?"

  • „Prüfe diese llms.txt auf kaputte Links und Links zu fremden Domains"

  • „Warum beschwert sich PageSpeed Insights über unsere llms.txt?"

Nicht für: Crawl-Kontrolle (dafür ist robots.txt da), URL-Erkennung (dafür ist sitemap.xml da) oder SEO-Audits der gesamten Website.

Verbinden

Claude Code (eine Zeile):

claude mcp add --transport http llms-txt https://www.llms-txt-generator.de/api/mcp

Jeder Client mit einem mcpServers-Block (Cursor, Windsurf, VS Code, …):

{
  "mcpServers": {
    "llms-txt": {
      "type": "streamable-http",
      "url": "https://www.llms-txt-generator.de/api/mcp"
    }
  }
}

Nur-stdio-Clients (z. B. Claude Desktop) über die npm-Brücke in diesem Repository:

{
  "mcpServers": {
    "llms-txt": {
      "command": "npx",
      "args": ["-y", "llmstxtgenerator-mcp"]
    }
  }
}

ChatGPT / OpenAI: Der Server spricht einfaches Streamable HTTP, funktioniert also als Connector und innerhalb des Apps SDK — derselbe MCP-Standard, auf dem OpenAIs Plugins seit 2026 aufbauen.

Werkzeuge

Werkzeug

Funktion

generate_llms_txt

Crawlt bis zu 15 öffentliche HTML-Seiten derselben registrierbaren Domain und liefert einen fertigen llms.txt-Entwurf. Deterministisch — kein Sprachmodell wird aufgerufen, keine Fakten werden erfunden.

validate_llms_txt

Validiert llms.txt-Text: H1, Zusammenfassung, Abschnitte, absolute Links, Duplikate, fremde Domains, Dateigröße, Aktualisierungsdatum. Liefert eine Punktzahl von 0–100 plus Schweregrad und Zeilennummern pro Befund.

check_published_llms_txt

Ruft die live ausgelieferte /llms.txt einer Domain ab, prüft Status und Content-Type und validiert den Inhalt.

check_lighthouse_agentic_browsing

Prüft Text exakt gegen die drei Lighthouse-llms-txt-Auditregeln, so wie Lighthouse sie implementiert, und meldet, welche davon fehlschlägt.

Typischer Ablauf: check_published_llms_txtgenerate_llms_txtvalidate_llms_txtcheck_lighthouse_agentic_browsing.

Jede Antwort enthält einen note-Hinweis, der die Lighthouse-Regeln wiederholt, damit ein Agent, der über das Ergebnis nachdenkt, dieses README nicht gelesen haben muss.

Was der Crawler tut und nicht tut

  • Liest die Startseite, robots.txt, Sitemaps und eine priorisierte Auswahl interner HTML-Seiten — maximal 15 Seiten, nur dieselbe registrierbare Domain.

  • Extrahiert Titel, Beschreibungen, Überschriften, Canonical-URLs und JSON-LD-Typen deterministisch. Fehlende Fakten bleiben fehlend.

  • Blockiert: private Netzwerke, interne Hostnamen, fremde Redirect-Ziele, nicht standardmäßige Ports, URLs mit Zugangsdaten, Nicht-HTTP(S)-Schemata, übermäßig große Antworten.

  • Von der Ausgabe ausgeschlossen: Parameter-URLs, noindex-Seiten, Duplikate, Fehlerantworten, Nicht-HTML-Dateitypen — jeweils mit Begründung.

  • Der Schnell-Crawl führt kein Seiten-JavaScript aus. Nur clientseitig vorhandene Inhalte können fehlen.

FAQ

Was ist llms.txt? Ein offener Vorschlag für eine Markdown-Datei unter /llms.txt, die Menschen und Maschinen einen kuratierten Überblick über eine Website gibt: eine H1 für den Namen, eine Blockquote-Zusammenfassung und H2-Abschnitte mit absoluten Links. Siehe llmstxt.org und unsere Einführung.

Verbessert llms.txt meine Google-Rankings? Nein. Die Google-Suche ignoriert es als Ranking-Signal. Was sich 2026 geändert hat, ist, dass Google Lighthouse es nun auf Struktur prüft. Das sind verschiedene Dinge, und wer etwas anderes behauptet, übertreibt.

Brauche ich einen API-Key? Nein. Die Endpunkte sind öffentlich und pro IP ratenbegrenzt.

Ist ein Sprachmodell beteiligt? Nein. Der Crawler und der Generator sind vollständig deterministisch. Beschreibungen stammen nur aus den eigenen Metadaten oder dem sichtbaren Text der Quellseite.

Warum nur 15 Seiten? Das hält den kostenlosen Dienst schnell und günstig im Betrieb, und eine gute llms.txt ist kuratiert statt erschöpfend. Größere Websites können sich gerne melden.

Wer betreibt das? track by track GmbH, Berlin — das Team hinter der Social-Media-Agentur famefact.

Wo ist die Datenschutzerklärung? Datenschutzerklärung · AGB.


Deutsch: llms.txt per KI-Agent erstellen, prüfen und reparieren

Der llms.txt Generator erzeugt aus einer Website eine kuratierte llms.txt — die Markdown-Datei, die KI-Systemen zeigt, welche Inhalte wirklich zählen. Dieser MCP-Server macht das für KI-Agenten nutzbar: Domain crawlen, Entwurf erzeugen, bestehende Datei validieren und gegen Googles neuen Lighthouse-Audit „Agentic Browsing" prüfen. Kostenlos, ohne API-Key, ohne Registrierung.

Status: live. Endpunkt: https://www.llms-txt-generator.de/api/mcp

claude mcp add --transport http llms-txt https://www.llms-txt-generator.de/api/mcp

Warum das gerade jetzt relevant ist

Seit Lighthouse 13.3 (August 2026) prüfen Google Lighthouse und PageSpeed Insights in der Kategorie „Agentic Browsing" auch /llms.txt. Der Audit verlangt drei Dinge: eine H1-Überschrift, mindestens einen echten Markdown-Link (Linktext in eckigen, URL in runden Klammern) und mehr als 50 Zeichen Inhalt.

Zwei Punkte überraschen die meisten:

  • Klartext-Links zählen nicht. Startseite: https://beispiel.de fällt durch, obwohl der Link funktioniert. Das ist der häufigste Grund, warum von Hand geschriebene Dateien scheitern.

  • Gar keine Datei besteht. Eine fehlende llms.txt gilt als „nicht zutreffend"; nur eine vorhandene mit Fehlern fällt durch. Eine kaputt veröffentlichte llms.txt ist schlechter als gar keine.

Der Audit ist eine Strukturprüfung, kein Rankingfaktor der Google-Suche.

Werkzeuge

Werkzeug

Funktion

generate_llms_txt

Crawlt bis zu 15 öffentliche HTML-Seiten derselben registrierbaren Domain und liefert einen fertigen llms.txt-Entwurf. Deterministisch — kein Sprachmodell, keine erfundenen Fakten.

validate_llms_txt

Prüft H1, Zusammenfassung, Abschnitte, absolute Links, Duplikate, fremde Domains, Dateigröße und Aktualisierungsdatum. Liefert 0–100 Punkte plus Befunde mit Schweregrad und Zeilennummer.

check_published_llms_txt

Ruft die live ausgelieferte /llms.txt einer Domain ab, prüft Status und Content-Type und validiert den Inhalt.

check_lighthouse_agentic_browsing

Prüft Text exakt gegen die drei Lighthouse-Regeln und benennt, welche davon fehlschlägt.

Sicherheit des Crawls

Blockiert werden private Netzwerke, interne Hostnamen, fremde Redirect-Ziele, nicht standardmäßige Ports, URLs mit Zugangsdaten und Nicht-HTTP(S)-Schemata. Ausgeschlossen werden Parameter-URLs, noindex-Seiten, Duplikate und Fehlerantworten — jeweils mit Begründung. Der Schnell-Crawl führt kein Seiten-JavaScript aus.


Dieses Repository enthält Dokumentation, Discovery-Metadaten (server.json) und die npm-stdio-Brücke. Der Server selbst wird von der track by track GmbH, Berlin (Impressum) betrieben.

Lizenz: MIT — siehe LICENSE.

-
license - not tested
Not graded
quality - not tested
C
maintenance

Maintenance

Maintainers
Response time
Release cycle
Releases (12mo)
Commit activity

Resources

Unclaimed servers have limited discoverability.

Looking for Admin?

If you are the server author, to access and configure the admin panel.

Related MCP Connectors

  • Generate 18 AI readiness files (llms.txt, ai.txt, RAG indexes, schema) for any website.

  • Scan any URL for AI agent readability — Vercel Spec, llmstxt.org, and agent-protocol manifests.

  • SEO research, audits, backlinks, GSC, and content workflow tools for AI agents.

View all MCP Connectors

Latest Blog Posts

MCP directory API

We provide all the information about MCP servers via our MCP API.

curl -X GET 'https://glama.ai/api/mcp/v1/servers/llms-txt-generator/llmstxtgenerator-mcp'

If you have feedback or need assistance with the MCP directory API, please join our Discord server