In ChatGPT & AI Overviews zitiert werden
So wird deine Website in ChatGPT, Perplexity, Claude und Googles AI Overviews als Quelle genannt: Technik, Answer-first-Texte, E-E-A-T und Messung.
In KI-Antworten zitiert wird, wer für die KI-Suche erreichbar ist, eine Frage klar und früh beantwortet und dabei glaubwürdig wirkt. Die Grundlage: Crawler zulassen, indexierbar bleiben, Antworten an den Anfang stellen, Autor und Datum sichtbar machen.
Inhalt
Wie Zitate in KI-Antworten entstehen
Wenn ChatGPT, Perplexity, Claude oder Googles AI Overviews eine Quelle verlinken, steckt fast immer dasselbe Prinzip dahinter: Retrieval-Augmented Generation (RAG). Das System formuliert aus der Frage eine oder mehrere Suchanfragen, holt passende Dokumente aus einem Suchindex, wählt die relevantesten Passagen aus und lässt das Sprachmodell daraus eine Antwort schreiben. Die Links unter oder in der Antwort sind die Dokumente, auf die sich die Antwort stützt.
Daraus folgt die wichtigste Erkenntnis: Zitiert wird nicht, was das Modell „weiß“, sondern was es in diesem Moment findet. Wissen aus dem Training erscheint meist ohne Link. Wer als Quelle auftauchen will, muss also in den Indizes stehen, die die jeweiligen Systeme abfragen – und dort mit einer gut extrahierbaren Passage überzeugen.
Wer welchen Index nutzt
| System | Quellen / Crawler | Was das für dich heißt |
|---|---|---|
| ChatGPT-Suche | Eigener Crawler OAI-SearchBot; laut OpenAI zusätzlich Drittanbieter-Suchdienste | OAI-SearchBot in der robots.txt erlauben. Ausgesperrte Seiten erscheinen laut OpenAI nicht in Suchantworten (höchstens als Navigationslink). |
| Google AI Overviews / AI Mode | Googles regulärer Suchindex (Googlebot) | Seite muss indexiert und mit Snippet anzeigbar sein. Kein Spezial-Markup nötig. |
| Perplexity | Eigener Index über PerplexityBot; Perplexity-User für Abrufe im Auftrag eines Nutzers | PerplexityBot zulassen. Perplexity-User ignoriert robots.txt laut eigener Doku in der Regel. |
| Claude | Claude-SearchBot und Claude-User; Anthropic führt Brave Search als Unterauftragsverarbeiter | Claude-SearchBot zulassen. Eine gute Sichtbarkeit in Brave Search schadet vermutlich nicht. |
| Microsoft Copilot | Bing-Index (Bingbot) | Klassische Bing-Indexierung pflegen, z. B. über Bing Webmaster Tools. |
Wie gewichtet wird, ist nicht öffentlich. OpenAI nennt neben dem eigenen Crawler „Drittanbieter-Suchdienste“, ohne die Gewichtung offenzulegen; Microsoft Bing gilt als langjähriger Partner. Dass Claude für die Websuche maßgeblich Brave nutzt, stützt sich auf Anthropics Liste der Unterauftragsverarbeiter und auf unabhängige Auswertungen – nicht auf eine ausführliche offizielle Beschreibung. Plane deshalb breit: Wer bei Google, Bing und den KI-eigenen Crawlern gut erreichbar ist, deckt die meisten Wege ab.
Answer-first schreiben
Ein RAG-System zieht selten ganze Seiten heran, sondern einzelne Abschnitte. Je schneller ein Abschnitt die Frage beantwortet, desto leichter lässt er sich zitieren. Journalisten nennen das umgekehrte Pyramide: das Wichtigste zuerst, Details danach.
So sieht ein zitierfähiger Abschnitt aus
- Überschrift als Frage oder klare Aussage: „Wie lang sollte ein Title-Tag sein?“ statt „Allgemeines“.
- Direkt darunter die Antwort in ein bis zwei Sätzen – vollständig verständlich, auch ohne den Rest der Seite. Faustregel: 40 bis 300 Zeichen.
- Dann die Details: Ausnahmen, Beispiele, Rechenwege, Quellen.
- Listen und Tabellen für Schritte, Vergleiche und Kennzahlen. Sie lassen sich sauber extrahieren.
- Ein Thema pro Abschnitt. Mischabschnitte („Preise, Versand und Garantie“) sind schwer zu zitieren.
- Eindeutige Begriffe: Nenne Produkt- und Firmennamen aus, statt „es“ oder „unser Tool“ zu schreiben – der Abschnitt steht im Zitat ohne Kontext.
Schlecht: „Hier kommt es auf viele Faktoren an, die wir im Folgenden genauer betrachten.“
Besser: „Ein Title-Tag sollte etwa 50 bis 60 Zeichen lang sein, weil Google längere Titel in den Suchergebnissen meist abschneidet.“
Answer-first heißt nicht, Inhalte zu kürzen. Die Tiefe bleibt wichtig – sie gehört nur hinter die Kernantwort, nicht davor.
E-E-A-T sichtbar machen
Google beschreibt Qualität mit E-E-A-T: Experience (eigene Erfahrung), Expertise, Authoritativeness (Autorität) und Trustworthiness (Vertrauenswürdigkeit). Das ist kein einzelner Rankingfaktor, sondern ein Rahmen für Signale, die auch außerhalb von Google für Glaubwürdigkeit stehen. Für KI-Suchen gilt das ebenso: Ein System, das zwischen zwei ähnlichen Passagen wählt, hat mehr Grund, der nachvollziehbaren Quelle zu folgen.
- Autor nennen: Name, kurze Bio, Qualifikation und Link auf eine Autorenseite. Im Markup als
authorvom TypPerson. - Datum zeigen: Veröffentlichung und letzte inhaltliche Aktualisierung sichtbar und im Markup (
datePublished,dateModified). - Betreiber erkennbar machen: Impressum, Kontakt, „Über uns“ und Datenschutzerklärung leicht auffindbar verlinken.
- Erfahrung belegen: Eigene Tests, Fotos, Messwerte, Fallbeispiele – Dinge, die nur du liefern kannst.
- Entität verknüpfen: Organization mit
sameAsauf offizielle Profile. Wie das geht, zeigt der Guide Strukturierte Daten für KI-Suche.
Quellen & Aktualität
Wer Fakten nennt, sollte zeigen, woher sie stammen. Verlinke Primärquellen – Gesetzestexte, Studien, Herstellerdokumentation, amtliche Statistiken – statt Sekundärartikel. Das hilft Lesern, und es macht deine Aussage überprüfbar.
- Zahlen mit Quelle und Stand: „laut Statistischem Bundesamt, Stand 2025“ statt „Studien zeigen“.
- Inhalte wirklich aktualisieren: Veraltete Preise, Fristen oder Versionsnummern sind ein häufiger Grund, warum eine Seite gegenüber frischeren Quellen verliert.
- dateModified ehrlich halten: Nur bei echten Änderungen anpassen. Ein automatisch auf „heute“ gesetztes Datum ohne neue Inhalte ist irreführend und kann Vertrauen kosten.
- Eigene Daten veröffentlichen: Umfragen, Benchmarks oder Auswertungen, die es nirgendwo sonst gibt, werden besonders gern als Quelle herangezogen – weil es keine Alternative gibt.
Ob KI-Crawler deine Seite lesen dürfen und ob Autor, Datum und strukturierte Daten vorhanden sind, zeigt dir PageScore in wenigen Sekunden.
Technische Voraussetzungen
Der beste Text wird nicht zitiert, wenn kein System ihn abrufen darf oder lesen kann. Prüfe mindestens diese Punkte:
- Crawler-Zugriff: Such- und Nutzer-Bots wie
OAI-SearchBot,PerplexityBot,Claude-SearchBot,GooglebotundBingbotdürfen nicht per robots.txt ausgesperrt sein. Trainings-Bots wieGPTBotkannst du getrennt davon blockieren – Details im Guide KI-Crawler in der robots.txt. - Kein noindex, kein nosnippet: Für Googles AI Overviews muss eine Seite indexiert sein und mit Snippet angezeigt werden dürfen.
nosnippetodermax-snippet:0schließen sie aus. - Inhalte ohne JavaScript: Viele KI-Crawler führen kein oder nur begrenzt JavaScript aus. Wichtiger Text sollte im ausgelieferten HTML stehen, nicht erst clientseitig nachgeladen werden.
- Firewall und Bot-Schutz: Manche CDN- oder WAF-Regeln blocken KI-Crawler pauschal. OpenAI etwa empfiehlt, zusätzlich zur robots.txt die veröffentlichten IP-Bereiche zuzulassen.
Alle zehn Faktoren im Überblick findest du im GEO Check; wie sich das Ganze von klassischem SEO unterscheidet, erklärt GEO vs. SEO.
Sichtbarkeit messen
Ein „Ranking“ wie in der klassischen Suche gibt es in KI-Antworten nicht – die Antworten variieren je nach Formulierung, Nutzer und Zeitpunkt. Messen lässt sich trotzdem einiges:
Referrer und UTM-Parameter
Klicks aus KI-Antworten tauchen in deiner Webanalyse als Verweise auf, etwa von chatgpt.com, perplexity.ai, gemini.google.com oder copilot.microsoft.com. ChatGPT hängt an Links aus der Suche zusätzlich utm_source=chatgpt.com an. Beides ist unvollständig: Nicht jede App oder jeder Browser überträgt einen Referrer, ein Teil dieser Besuche landet als „Direkt“ in der Statistik.
Google Search Console
Klicks und Impressionen aus AI Overviews und AI Mode zählt Google laut eigener Dokumentation zum normalen Suchtraffic im Suchtyp „Web“. Einen eigenen Filter dafür gibt es nicht – du siehst die Effekte nur indirekt, etwa bei Impressionen ohne entsprechenden Klickanstieg.
Server-Logs
In deinen Access-Logs siehst du, welche Crawler tatsächlich vorbeikommen: OAI-SearchBot, ChatGPT-User, PerplexityBot, Claude-SearchBot, Claude-User und andere. Abrufe durch Nutzer-Bots (ChatGPT-User, Claude-User, Perplexity-User) zeigen, dass jemand im Chat gerade eine deiner Seiten angefordert hat. Achtung: User-Agents lassen sich fälschen; verlässlich ist erst der Abgleich mit den veröffentlichten IP-Bereichen der Anbieter.
Manuelle Prompt-Tests
Lege eine Liste von 10 bis 30 Fragen an, die deine Zielgruppe stellen würde, und prüfe regelmäßig, welche Quellen ChatGPT, Perplexity, Claude und Google nennen. Dokumentiere Datum, Formulierung und Ergebnis. Das ist keine Statistik, zeigt aber Tendenzen und Wettbewerber, die du sonst nicht siehst.
Häufige Fragen
Kann ich dafür bezahlen, in ChatGPT zitiert zu werden?
Für die organischen Quellenangaben in Suchantworten gibt es kein bezahltes Programm. Sichtbar wirst du über Erreichbarkeit für OAI-SearchBot, relevante Inhalte und klare Antworten. Werbeformate, sofern angeboten, sind davon getrennt.
Muss ich GPTBot erlauben, um in ChatGPT zu erscheinen?
Nein. GPTBot sammelt Trainingsdaten. Für die ChatGPT-Suche ist OAI-SearchBot zuständig. Du kannst GPTBot blockieren und OAI-SearchBot erlauben.
Brauche ich besonderes Markup für AI Overviews?
Nein. Google schreibt, dass weder spezielle Dateien noch spezielles Schema.org-Markup nötig sind. Die Seite muss indexiert und mit Snippet anzeigbar sein.
Wie schnell wirken Änderungen an der robots.txt?
OpenAI und Perplexity nennen jeweils rund 24 Stunden, bis Änderungen berücksichtigt werden. Bis eine Seite dann tatsächlich neu gecrawlt und zitiert wird, kann es länger dauern.
Warum wird meine Seite nicht zitiert, obwohl sie bei Google gut rankt?
Mögliche Gründe: Der KI-eigene Crawler ist ausgesperrt, der Inhalt steht erst nach JavaScript-Ausführung im HTML, die Antwort ist tief im Text versteckt oder ein anderes System nutzt einen anderen Index, in dem deine Seite schwächer ist.
Hilft eine llms.txt-Datei beim Zitiertwerden?
Das ist nicht belegt. Keiner der großen Anbieter hat bestätigt, llms.txt für Suchantworten auszuwerten. Die Datei schadet nicht, sollte aber keine Priorität vor Crawler-Zugriff und guten Inhalten haben.