Website für KI optimieren: In ChatGPT sichtbar werden

Immer mehr Menschen stellen ihre Frage nicht mehr bei Google, sondern direkt in ChatGPT – und bekommen eine fertige Antwort samt Quellenangabe. Für Unternehmen verschiebt sich damit eine zentrale Frage: Es geht nicht mehr nur darum, auf Platz eins zu ranken, sondern darum, ob ein KI-System die eigenen Inhalte überhaupt lesen und korrekt zuordnen kann.
Wer seine Website für KI optimieren will, landet deshalb schnell bei technischen Fragen: Welche Crawler greifen überhaupt zu? Was steht wirklich im Quelltext? Und welche der vielen kursierenden Empfehlungen bringen messbar etwas – und welche nicht? Dieser Beitrag ordnet das ein, mit Blick auf das, was sich tatsächlich belegen lässt.

Wie ChatGPT überhaupt an Ihre Inhalte kommt

OpenAI betreibt keinen einzelnen Crawler, sondern drei, mit klar getrennten Aufgaben. Diese Unterscheidung ist wichtig, weil viele Websites pauschal alles sperren – und sich damit unbeabsichtigt aus der Suche in ChatGPT nehmen.

  • GPTBot – Aufgabe: Sammelt Daten für das Training künftiger Modelle. robots.txt: wird beachtet
  • OAI-SearchBot – Aufgabe: Baut den Suchindex auf, den die Suche in ChatGPT nutzt. robots.txt: wird beachtet
  • ChatGPT-User – Aufgabe: Ruft eine Seite ab, wenn ein Mensch sie im Chat verlinkt oder erfragt. robots.txt: nur eingeschränkt

Der praktische Unterschied: Wer nur GPTBot sperrt, verhindert die Nutzung der eigenen Inhalte fürs Modelltraining, bleibt in der Suche innerhalb von ChatGPT aber weiterhin auffindbar. Wer dagegen OAI-SearchBot sperrt, verschwindet aus genau dem Index, aus dem ChatGPT seine zitierten Quellen zieht.

Was Ihre robots.txt tatsächlich entscheidet

Die robots.txt ist damit kein Nebenschauplatz, sondern eine strategische Entscheidung – und sie sollte bewusst getroffen werden, nicht per Plugin-Voreinstellung. Sinnvoll ist, drei Fragen zu klären: Sollen die eigenen Inhalte ins Modelltraining einfließen? Soll die Marke in KI-Antworten zitierbar sein? Und gibt es Bereiche, etwa Kundenportale oder interne Dokumente, die grundsätzlich außen vor bleiben müssen?
Die Antworten fallen je nach Geschäftsmodell unterschiedlich aus. Ein Verlag entscheidet anders als ein Maschinenbauer, der froh über jede korrekte Erwähnung ist. Falsch ist nur, die Frage gar nicht zu stellen.

Die häufigste Bremse: Inhalte, die im Quelltext gar nicht stehen

Der technisch größte Hebel liegt woanders, als die meisten vermuten. KI-Crawler führen kein JavaScript aus. Eine Auswertung von echtem Crawler-Traffic durch Vercel zeigte, dass GPTBot JavaScript-Dateien zwar in rund 11,5 Prozent der Anfragen lädt, sie aber nicht ausführt; bei ClaudeBot lag der Wert bei knapp 24 Prozent, ebenfalls ohne Ausführung. Kein größerer KI-Crawler rendert derzeit JavaScript.
Für die Praxis heißt das: Alles, was erst nachträglich im Browser aufgebaut wird – Tab-Inhalte, Akkordeons, per Skript nachgeladene Produktdaten, ganze Single-Page-Anwendungen – existiert für diese Systeme nicht. Der Test dafür dauert dreißig Sekunden: Quelltext der Seite anzeigen und prüfen, ob die zentralen Aussagen dort als Text auftauchen. Tun sie das nicht, hilft auch die beste inhaltliche Optimierung nicht weiter.

Gegenüberstellung von Inhalten, die KI-Crawler zuverlässig lesen, und Inhalten, die für sie unsichtbar bleiben

Die Lösung ist selten ein Neubau. Meist genügt es, die tragenden Inhalte serverseitig auszuliefern oder vorzurendern, während Interaktionen weiterhin im Browser laufen dürfen. Auch bei WordPress-Seiten lohnt der Blick: Manche Page-Builder verlagern mehr in JavaScript, als nötig wäre.
Sie wissen nicht, was von Ihrer Website im Quelltext ankommt? Wir schauen uns das in einer unverbindlichen Erstberatung gemeinsam an.

Strukturierte Daten: Kontext, den Maschinen sicher lesen

Fließtext lässt Spielraum für Interpretation, strukturierte Daten nicht. Mit Schema.org-Auszeichnungen hinterlegen Sie maschinenlesbar, was ein Text nur beschreibt: dass „Müller GmbH“ ein Unternehmen mit dieser Adresse ist, dass ein Abschnitt eine Frage samt Antwort enthält, dass ein Beitrag an einem bestimmten Datum aktualisiert wurde.

Welche Auszeichnungen sich zuerst lohnen

Nicht alles muss ausgezeichnet werden. Für die meisten Unternehmenswebsites deckt eine überschaubare Auswahl den Großteil ab:

  • Organization – Firmenname, Adresse, Logo, Kontaktwege und Profile auf anderen Plattformen
  • Service oder Product – die einzelnen Leistungen, jeweils auf ihrer eigenen Unterseite
  • FAQPage – Fragen und Antworten in genau der Form, in der ein System sie zitieren kann
  • Article – Autorenschaft, Veröffentlichungs- und Aktualisierungsdatum bei Blogbeiträgen
  • BreadcrumbList – die Einordnung einer Seite in die Gesamtstruktur

Widersprüche kosten mehr als fehlende Angaben

Entscheidend ist die Konsistenz. Wenn im Impressum eine andere Schreibweise des Firmennamens steht als in den strukturierten Daten, im Google-Unternehmensprofil eine dritte und auf LinkedIn eine vierte, entsteht für ein Sprachmodell kein klares Bild einer Marke, sondern eine unscharfe Menge ähnlicher Einträge. Eine einheitliche Schreibweise über alle Kanäle hinweg ist billiger umzusetzen als jede technische Maßnahme – und wirkt oft schneller.

llms.txt: Was der Standard leistet – und was nicht

Kaum ein Thema wird derzeit so stark beworben wie die llms.txt – eine Datei im Wurzelverzeichnis, die KI-Systemen die wichtigsten Inhalte einer Website in aufbereiteter Form anbieten soll. Die Idee ist nachvollziehbar. Die Belege dafür sind es bislang nicht.
Google Search Central hält in der eigenen Dokumentation fest, dass die Suche llms.txt nicht verwendet; John Mueller verglich das Format öffentlich mit dem längst bedeutungslosen Keywords-Meta-Tag. Eine Auswertung von Ahrefs kam im Mai 2026 zu dem Ergebnis, dass 97 Prozent aller angelegten llms.txt-Dateien nie abgerufen wurden – bei über 500 Millionen ausgewerteten Zugriffen von KI-Bots entfielen nur rund 400 Anfragen auf diese Datei.
Das heißt nicht, dass die Datei schadet. Unternehmen wie Stripe, Vercel oder Cloudflare setzen sie ein – allerdings für Coding-Agenten wie Cursor oder GitHub Copilot, die sie als Navigationshilfe nutzen. Als Baustein für Sichtbarkeit in KI-Suchergebnissen taugt sie nach heutigem Stand nicht. Wer eine halbe Stunde investieren möchte, kann sie anlegen. Wer zwischen llms.txt und serverseitigem Rendering wählen muss, sollte ohne Zögern das Rendering nehmen.

Inhalte, die sich zitieren lassen

Technik schafft Lesbarkeit, zitiert wird trotzdem nur, was inhaltlich eindeutig ist. KI-Systeme greifen bevorzugt auf Passagen zurück, die für sich allein stehen können – ein Satz, der auch ohne den Absatz davor verständlich bleibt.
In der Praxis bedeutet das: Definitionen früh und wörtlich formulieren, statt sie über mehrere Absätze zu umkreisen. Zahlen mit Bezugsgröße und Zeitraum nennen. Aufzählungen dort einsetzen, wo tatsächlich mehrere gleichrangige Punkte vorliegen. Und für jede Seite eine Kernaussage festlegen, die in ein bis zwei Sätzen passt. Diese Anforderungen decken sich weitgehend mit gutem Fachtext – der Unterschied liegt darin, dass Unschärfe jetzt sichtbare Kosten hat.

Technische Checkliste für KI-Sichtbarkeit mit fünf Maßnahmen von serverseitigem Rendering bis Ladezeit

Ein Punkt, der dabei häufig untergeht: Aktualität ist selbst ein Signal. Ein Beitrag mit erkennbarem Aktualisierungsdatum und aktuellen Zahlen wird eher herangezogen als ein inhaltlich ähnlicher Text ohne Datumsangabe. Wer regelmäßig Fachbeiträge veröffentlicht, baut damit über die Zeit eine Grundlage auf, auf die KI-Systeme zurückgreifen können.
Sie möchten wissen, wie Ihre Website aktuell von KI-Systemen gelesen wird? Fragen Sie eine kostenlose Erstberatung an – wir prüfen Quelltext, robots.txt und strukturierte Daten.

So gehen wir bei online at media vor

Wir beginnen mit einer technischen Bestandsaufnahme: Was steht im ausgelieferten HTML, welche Crawler greifen laut Serverprotokoll tatsächlich zu, welche strukturierten Daten sind vorhanden und valide? Erst danach entscheidet sich, ob es um kleinere Korrekturen geht oder um einen grundsätzlicheren Umbau der Auslieferung.
Die Umsetzung liegt in der Web-Entwicklung, die inhaltliche Ausrichtung im Digital Marketing – getrennt betrachtet funktioniert beides nur halb. Zur technischen Grundlage gehören außerdem Ladezeit und Erreichbarkeit: Auch Crawler brechen bei Zeitüberschreitungen ab, weshalb die Kennzahlen aus dem Performance Marketing hier direkt einzahlen. Und eine Seite, die kompromittiert wurde, verliert Sichtbarkeit unabhängig von jeder Optimierung – wie sich das absichern lässt, steht in unserem Beitrag zur WordPress-Sicherheit 2026.
Messbar wird das Ganze über Serverprotokolle, in denen sich Zugriffe der KI-Crawler nachvollziehen lassen, sowie über die Frage, ob und wie die Marke in KI-Antworten auftaucht. Wie sich Sichtbarkeit sauber in Zahlen fassen lässt, haben wir am Beispiel der Social Media KPIs beschrieben – die Logik ist dieselbe.
Sie wollen, dass Ihre Inhalte in KI-Antworten auftauchen statt daran vorbeizulaufen? Vereinbaren Sie Ihre unverbindliche Erstberatung – wir prüfen Ihre Website auf technische KI-Lesbarkeit.

FAQ