Kurze Antwort: Prüfen Sie sechs Dinge in dieser Reihenfolge: dass die robots.txt den Crawler der Antwortmaschine zulässt, dass die Seite den Status 200 liefert, dass nichts sie als noindex markiert, dass der Hauptinhalt ohne JavaScript im rohen HTML steht, dass die Snippet-Steuerung das Zitieren nicht verhindert und dass die Seite klare Überschriften und eine direkte Antwort hat. Wenn alle sechs bestehen, ist die Seite lesbar. Ob sie zitiert wird, ist eine andere Frage.
Warum ist "lesbar" nicht dasselbe wie "im Browser sichtbar"?
Ein Browser führt JavaScript aus, lädt Schriften, wartet auf Skripte und zeigt Ihnen die fertige Seite. Viele Crawler tun deutlich weniger. Tests, die Ende 2024 veröffentlicht wurden, ergaben, dass die großen KI-Crawler das rohe HTML abriefen und kein JavaScript ausführten. Eine Seite, die in Chrome perfekt aussieht, kann für sie fast leer sein.
Eine subtilere Variante davon haben wir auf unserer eigenen Website erlebt. Unser Framework streamte den Seitentitel und das Canonical-Tag für die meisten Besucher in den Body des HTML und schickte sie nur einer Allowlist von Bots im <head>, auf der kein einziger KI-Crawler stand. Bei einer Messung am 22. September 2026 erhielt GPTBot das <title> bei Byte 29.701 der Seite, nach der Hauptüberschrift. Bingbot erhielt es bei Byte 1.533. Für jeden Menschen sah die Seite gut aus. Wir haben das behoben, indem wir die Bot-Allowlist erweitert haben, und der Titel kommt jetzt auch bei KI-Crawlern bei Byte 1.985 an.
Die Lehre daraus: Prüfen Sie immer, was der Crawler erhält, nicht, was Sie sehen.
Welche sechs Prüfungen sind das?
1. Crawler-Zugriff
Öffnen Sie yourdomain.com/robots.txt und prüfen Sie die Gruppen für OAI-SearchBot (ChatGPT-Suche), PerplexityBot, Claude-SearchBot und Googlebot. Ein Disallow: / unter User-agent: * sperrt jeden Crawler ohne eigene Gruppe. Unser kostenloser Checker liest die Datei für Sie und listet auf, welche KI-Crawler zugelassen sind; die Crawler-Liste erklärt, was jeder einzelne tut.
2. Statuscode
Die Seite muss 200 liefern. Weiterleitungsketten, Soft 404 und Seiten, die 200 liefern, aber eine Fehlermeldung anzeigen, verwirren Crawler. Prüfen können Sie das mit curl -I https://yourdomain.com/page.
3. Indexierbarkeit
Suchen Sie im HTML nach <meta name="robots" content="noindex"> und in der Antwort nach einem Header X-Robots-Tag: noindex. Prüfen Sie, ob das Canonical-Tag auf die Seite selbst zeigt und nicht auf die Startseite oder eine andere URL. Ein falsches Canonical sagt Maschinen, dass sie die Seite zugunsten einer anderen ignorieren sollen.
4. Inhalt im rohen HTML
Rufen Sie die Seite ohne JavaScript ab und suchen Sie nach Ihrem Haupttext:
curl -s -A "Mozilla/5.0 (compatible; GPTBot/1.2)" https://yourdomain.com/page | less
Fehlen in dieser Ausgabe die Überschrift, der erste Absatz und die zentralen Fakten, können KI-Crawler sie wahrscheinlich nicht lesen. Die Lösung ist serverseitiges Rendering oder statische Generierung für wichtige Inhalte.
5. Snippet-Steuerung
nosnippet, max-snippet:0 und data-nosnippet weisen Maschinen an, Text nicht zu zitieren. Google wendet sie auch auf KI-Funktionen in der Suche an. Setzen Sie sie gezielt für Text ein, der nicht zitiert werden soll, und nicht versehentlich in einem ganzen Template.
6. Struktur und eine direkte Antwort
Lesbar ist nicht dasselbe wie nützlich. Prüfen Sie, ob die Seite eine klare H1, aussagekräftige Zwischenüberschriften und einen ersten Absatz hat, der die Hauptfrage der Seite beantwortet. Maschinen übernehmen eigenständige Passagen; eine Seite, die erst im achten Absatz auf den Punkt kommt, gibt ihnen wenig zum Zitieren.
Gibt es einen schnelleren Weg, alle sechs zu prüfen?
Ja. Unser kostenloser Einzelseiten-Check ruft eine URL einmal ab und führt die 88 seitenbezogenen Prüfungen aus unserem Prüfregister darauf aus: Struktur, Schema, Antwortbereitschaft und Zitierfähigkeit. Jeder Befund zeigt den Beleg, sodass Sie ihn selbst nachprüfen können. Ein Konto ist nicht nötig.
Speziell für Google zeigt das URL-Prüftool in der Search Console das von Google gerenderte HTML und ob die Seite indexiert ist.
Was ist das Gegenstück im klassischen SEO?
Alle sechs Prüfungen sind technisches SEO nach Lehrbuch: robots.txt, Statuscodes, Indexierungsanweisungen, Rendering und OnPage-Struktur. Der Unterschied bei der KI-Suche: Sie müssen jetzt mehrere Crawler zufriedenstellen, von denen einige weniger rendern als Googlebot, deshalb zählt serverseitig gerenderter Inhalt mehr.
Häufig gestellte Fragen
Führen KI-Crawler JavaScript aus?
Viele nicht. Gehen Sie davon aus, dass Inhalte, die erst nach dem Ausführen von JavaScript erscheinen, für KI-Crawler unsichtbar sein können, und rendern Sie wichtige Inhalte auf dem Server.
Meine Seite ist in Google indexiert. Kann ChatGPT sie lesen?
Nicht unbedingt. Die ChatGPT-Suche nutzt OAI-SearchBot und einen eigenen Index. Prüfen Sie, ob OAI-SearchBot zugelassen ist und ob Ihr Inhalt im rohen HTML steht.
Garantiert die Behebung dieser Punkte Zitierungen?
Nein. Diese Prüfungen machen eine Seite lesbar. Ob sie zitiert wird, hängt außerdem davon ab, ob sie zur Frage passt und eine zitierfähige Passage enthält. Das erklären wir in wie KI-Maschinen entscheiden, welche Marken sie zitieren.
