Guide

Was ist llms.txt – und braucht Ihre Website die Datei?

Eine kleine Markdown-Datei im Stammverzeichnis sagt KI-Systemen, was Ihre Website ist und welche Seiten zählen. So funktioniert sie – und dann lohnt sie sich.

Von WebDoctor-Redaktion·16. Juli 2026·3 Min. Lesezeit


llms.txt ist eine reine Markdown-Datei im Stammverzeichnis Ihrer Website, die KI-Systemen mitteilt, worum es auf Ihrer Site geht und welche Seiten wichtig sind – in einem Format, das eigens für Sprachmodelle entworfen wurde. Es handelt sich um einen Community-Vorschlag von llmstxt.org, nicht um einen offiziellen Standard. Aber die Kosten belaufen sich auf eine kleine Textdatei, und etliche KI-Tools lesen sie bereits heute.

Welches Problem die Datei löst

Will ein Sprachmodell Ihre Website verstehen, hat es zwei schlechte Optionen. Es kann rohes HTML crawlen und sich durch Navigation, Cookie-Banner und Skripte zum eigentlichen Inhalt durcharbeiten. Oder es verlässt sich auf das, was in seinen Trainingsdaten gelandet ist – und das ist oft veraltet. Dazu kommt: Kontextfenster sind begrenzt. Jedes Token, das für Boilerplate draufgeht, fehlt hinterher für Ihren tatsächlichen Inhalt.

llms.txt ist die Abkürzung: eine kuratierte, LLM-freundliche Landkarte, die sagt „das sind wir, und diese Seiten lohnen die Lektüre“ – in sauberem Markdown, das Modelle nativ parsen.

Das Format an einem Beispiel

Die gesamte Spezifikation passt in vier Regeln. Eine #-Überschrift mit dem Namen der Website (Pflicht). Optional ein >-Blockzitat mit einer einzeiligen Zusammenfassung. Optional etwas Fließtext. Danach ##-Abschnitte mit Markdown-Links, jeder mit einer optionalen Beschreibung:

# CellChart

> Knopfzellen-Kreuzreferenz: jeder Alias, jede Größe
und jedes Äquivalent für 92 Zellen.

## Batteriefamilien

- [LR44-Äquivalente](https://example.com/lr44/): alle Namen
  der LR44 und was sie ersetzt
- [CR2032 vs. CR2025](https://example.com/cr2032-vs-cr2025/):
  die zwei am häufigsten verwechselten Knopfzellen

Ein Abschnitt mit dem Namen ## Optional hat eine Sonderbedeutung: Modelle dürfen ihn überspringen, wenn das Kontextfenster knapp wird. Die Pflichtlektüre gehört deshalb in die vorderen Abschnitte, das Nice-to-have nach hinten unter „## Optional“.

llms.txt vs. robots.txt vs. sitemap.xml

DateiZielgruppeAussageFormat
robots.txtAlle Crawler„Diese Pfade dürft ihr crawlen – diese nicht“Direktiven
sitemap.xmlSuchmaschinen-Crawler„Hier ist jede Seite, vollständig“XML
llms.txtSprachmodelle„Hier ist das Wichtige, kuratiert“Markdown

Die drei Dateien ergänzen einander, statt zu konkurrieren: robots.txt regelt den Zugriff, die Sitemap strebt Vollständigkeit an, llms.txt setzt auf Kuration. Eine Begleitdatei namens llms-full.txt geht optional einen Schritt weiter und nimmt den vollständigen Text Ihrer Kernseiten direkt in die Datei auf – für Modelle, die alles in einem einzigen Abruf haben wollen. Starten Sie ohne sie; für die meisten Websites genügt llms.txt.

Der ehrliche Stand der Verbreitung

Seien Sie skeptisch, wenn jemand llms.txt als Ranking-Trick verkauft. Google hat erklärt, die Datei nicht zu verwenden, und keine große Suchmaschine hat sich öffentlich auf sie festgelegt. Die Verbreitung ist real, aber ungleich verteilt: Dokumentationsplattformen wie Mintlify erzeugen die Datei für Tausende Docs-Sites, Unternehmen wie Anthropic und Cloudflare veröffentlichen eine, und eine wachsende Zahl von KI-Entwicklertools ruft sie ab, wenn sie vorhanden ist.

Die passende Einordnung lautet: günstige Versicherung. Die Datei ist in Minuten erstellt, schadet nichts – und wenn KI-Assistenten als Traffic-Quelle weiter wachsen, stehen die Websites mit sauberer maschinenlesbarer Landkarte zuerst da. Diese Asymmetrie, winzige Kosten gegen einen plausiblen Nutzen, ist das ganze Argument. Und sie genügt.

Typische Fehler

  • Jede URL hineinkippen. Dafür gibt es die Sitemap. Eine llms.txt mit 5.000 Links ist für ein Modell exakt so nützlich wie gar keine Datei. Kuratieren Sie 10 bis 30 Seiten.
  • Falscher Ablageort. Die Datei gehört ins Stammverzeichnis: https://ihredomain.de/llms.txt. Unterverzeichnisse sind nicht Teil des Vorschlags, und Tools prüfen ausschließlich die Root.
  • HTML statt Markdown ausliefern. Manche Hosts leiten unbekannte Pfade auf eine Fehlerseite mit Status 200 um. KI-Tools parsen dann Ihre 404-Seite als Site-Beschreibung. Prüfen Sie, was die URL tatsächlich zurückgibt.
  • Vage Beschreibungen. „Nützliche Ressourcen“ sagt einem Modell nichts. „Ablaufregeln für 14 Kindersitz-Marken, geprüft gegen die Herstellerseiten“ – so etwas wird korrekt zitiert.
  • Einmal schreiben, nie wieder anfassen. Tote Links in der Datei schicken Modelle auf 404-Seiten. Generieren Sie die Datei neu, wenn sich Kernseiten ändern.

In fünf Minuten erstellt

Unser kostenloser llms.txt-Generator liest Ihre Sitemap und Ihre Seiten-Metadaten aus und setzt die Datei für Sie zusammen. Lesen Sie das Ergebnis durch, korrigieren Sie, was schief klingt, und laden Sie die Datei neben Ihre robots.txt hoch. Führen Sie anschließend den AI-Readiness-Check aus: Er bestätigt, dass die Datei erreichbar und gültig ist – und zeigt Ihnen im selben Durchlauf den Rest Ihrer KI-Schnittstelle, von den robots.txt-Regeln bis zu den strukturierten Daten.

llms.txtKI-Suche

Frequently asked questions

Ist llms.txt ein offizieller Webstandard?
Nein. Es ist ein Community-Vorschlag (llmstxt.org, September 2024) mit wachsender Verbreitung – vergleichbar mit dem Stand von Sitemaps, bevor sich die Suchmaschinen darauf einigten. Keine große Suchmaschine hat sich festgelegt, und Google hat erklärt, die Datei nicht zu nutzen. Sie ist eine günstige Versicherung, keine Garantie.
Verbessert llms.txt mein Google-Ranking?
Nein. Auf klassische Suchrankings hat die Datei keinen Einfluss. Ihr Wert liegt bei KI-Assistenten und Antwortmaschinen, die sie lesen, um Ihre Website zu verstehen und zu zitieren. Für Google-Rankings leisten Sitemap, strukturierte Daten und Inhaltsqualität die Arbeit.
Was unterscheidet llms.txt von llms-full.txt?
llms.txt ist der kuratierte Index: Links mit kurzen Beschreibungen. llms-full.txt nimmt optional den vollständigen Inhalt dieser Seiten in eine einzige Datei auf – nützlich für Dokumentations-Sites, bei denen ein Modell von allem in einem Abruf profitiert. Die meisten Websites brauchen nur llms.txt.
Wie viele Seiten sollte llms.txt auflisten?
So viele, dass alles abgedeckt ist, was ein KI-Assistent über Sie wissen soll – und keine mehr. Für die meisten Websites sind das 10 bis 30 Links in 2 bis 4 Abschnitten. Die Datei ist eine Leseliste, kein Inventar: Pflichtlektüre nach vorn, wirklich Verzichtbares in einen Abschnitt „## Optional“.
Wie prüfe ich, ob meine llms.txt gültig ist?
Rufen Sie ihredomain.de/llms.txt im Browser auf und stellen Sie sicher, dass reines Markdown zurückkommt – keine HTML-Fehlerseite. Lassen Sie die Datei anschließend durch unseren AI-Readiness-Check laufen: Er validiert Titelzeile, Zusammenfassung und Link-Abschnitte und markiert Formatprobleme.

Jetzt prüfen

Weiterlesen