AI-Readiness: So zitieren ChatGPT und Perplexity Sie
KI-Assistenten empfehlen nur Websites, die sie crawlen, verstehen und einordnen können. Das sind drei getrennte Probleme – und die meisten Sites scheitern an mindestens einem, ohne es zu wissen.
AI-ready ist eine Website dann, wenn Antwortmaschinen wie ChatGPT, Perplexity und Googles KI-Ergebnisse sie crawlen, verstehen und zitieren können. Dahinter stecken drei getrennte Ebenen: der Zugang, den die robots.txt steuert; das Verständnis, das strukturierte Daten und Metadaten liefern; und die Orientierung, die eine llms.txt gibt. Jede Ebene kann unabhängig von den anderen kaputt sein – und die meisten Websites haben mindestens eine Lücke.
Warum daraus eine eigene Disziplin wurde
Ein wachsender Teil der Fragen, die früher Google-Suchen waren, wird heute direkt im KI-Assistenten beantwortet – mit einer Handvoll zitierter Quellen. Eine dieser Zitationen zu sein ist die neue Position eins. Klassisches SEO bleibt dabei relevant, denn Antwortmaschinen stützen sich auf Suchindizes, um Kandidaten zu finden. Aber die Überschneidung ist nur teilweise: Eine Website kann in den blauen Links ordentlich ranken und trotzdem in KI-Antworten unsichtbar sein – weil sie vor zwei Jahren, mitten in der Debatte um Trainingsdaten, einen Crawler ausgesperrt hat.
Ebene 1: Zugang. Wer darf Ihre Website lesen?
Jedes große KI-System crawlt mit einem benannten User-Agent, und Ihre robots.txt entscheidet Bot für Bot. Die entscheidende Unterscheidung ist, wozu der jeweilige Bot dient: Einen Trainings-Bot zu blockieren betrifft nur künftige Modellgewichte. Einen Such-Bot zu blockieren entfernt Sie ab sofort aus den Antworten dieser Suchmaschine.
| Crawler | Betreiber | Blockieren bedeutet |
|---|---|---|
GPTBot, OAI-SearchBot | OpenAI | ChatGPT kann Sie weder lesen noch zitieren |
ClaudeBot | Anthropic | Claude kann Sie weder lesen noch zitieren |
PerplexityBot | Perplexity | In Perplexity-Antworten nicht vorhanden |
Google-Extended | Nur Gemini-Training; AI Overviews bleiben unberührt | |
CCBot | Common Crawl | Raus aus vielen Trainingsdatensätzen; keine Auswirkung auf die Suche |
Die häufigste selbst zugefügte Wunde: eine pauschale „alle KI-Bots aussperren“-robots.txt aus dem Jahr 2023, damals als Statement zu Trainingsdaten gedacht – und heute noch in Kraft, obwohl dieselben User-Agents inzwischen Suchprodukte antreiben. Entscheiden Sie pro Bot, auf Basis dessen, was er heute tut.
Ebene 2: Verständnis. Können Maschinen parsen, was Sie meinen?
Antwortmaschinen lesen Seiten nicht wie Menschen. Diese Signale werten sie am zuverlässigsten aus:
- Strukturierte Daten als JSON-LD. schema.org-Markup (Organization, FAQPage, Article, Product) ist eindeutige, maschinenlesbare Faktenlage – und genau das, was am saubersten in Antworten extrahiert wird. FAQ-Markup ist besonders wirksam, weil es buchstäblich in Frage-Antwort-Form vorliegt.
- Ehrliche Metadaten. Ein spezifischer Title-Tag, eine echte Meta-Description, eine kanonische URL und genau eine klare H1 pro Seite. Fehlen sie, greifen KI-Snippets ersatzweise auf beliebigen Seitentext zurück.
- Inhalte in Antwortform. Seiten, die die Antwort im ersten Absatz nennen, werden zitiert; Seiten, die sie unter 800 Wörtern Vorgeplänkel begraben, werden übersprungen. Vergleichstabellen und FAQ-Abschnitte sind konstruktionsbedingt extraktionsfreundlich.
Ebene 3: Orientierung. Haben Sie eine Landkarte hinterlassen?
Eine llms.txt-Datei gibt Modellen einen kuratierten Index Ihrer Website in Markdown. Sie ist die jüngste und am wenigsten standardisierte Ebene – genau deshalb ist sie Ebene drei und nicht Ebene eins: Kümmern Sie sich darum, nachdem Zugang und Verständnis stimmen, nicht stattdessen. Mit einem Generator ist die Datei in Minuten erstellt und schließt den Kreis.
Die Fix-first-Checkliste
- Führen Sie den AI-Readiness-Check für Ihre Domain aus. Er bewertet alle drei Ebenen in rund zehn Sekunden.
- Entsperren Sie die KI-Such-Crawler, von denen Sie zitiert werden wollen. Das ist die wirksamste Einzelmaßnahme – und eine einzige Änderung an der robots.txt.
- Ergänzen Sie JSON-LD auf Ihren zentralen Seitentypen, beginnend mit Organization auf der Startseite und FAQPage überall dort, wo Sie tatsächlich Fragen beantworten.
- Schließen Sie die Metadaten-Lücken, die der Check meldet: Titles, Descriptions, Canonicals.
- Stellen Sie sicher, dass Ihre Sitemap gültig und in der robots.txt deklariert ist – Antwortmaschinen finden Sie über Suchindizes. Was Google dazu erwartet, steht in der Search-Central-Dokumentation.
- Fügen Sie zuletzt die llms.txt hinzu und lassen Sie den Check erneut laufen, bis alles grün ist.
Was AI-Readiness nicht ist
Ein Trick ist es nicht, und einen geheimen Meta-Tag gibt es auch nicht. Systeme, die Fragen beantworten sollen, belohnen dasselbe, was gutes technisches SEO schon immer belohnt hat: erreichbare Seiten, eindeutige Struktur, Inhalte, die tatsächlich etwas beantworten. Der Unterschied liegt in der Konsequenz. Ein menschlicher Besucher verzeiht eine fehlende Meta-Description; eine Extraktions-Pipeline zieht kommentarlos zur nächsten Quelle weiter. AI-Readiness ist technische Hygiene – nur mit deutlich geringerer Fehlertoleranz.