In ChatGPT & AI Overviews zitiert werden

So wird deine Website in ChatGPT, Perplexity, Claude und Googles AI Overviews als Quelle genannt: Technik, Answer-first-Texte, E-E-A-T und Messung.

In KI-Antworten zitiert wird, wer für die KI-Suche erreichbar ist, eine Frage klar und früh beantwortet und dabei glaubwürdig wirkt. Die Grundlage: Crawler zulassen, indexierbar bleiben, Antworten an den Anfang stellen, Autor und Datum sichtbar machen.

Wie Zitate in KI-Antworten entstehen

Wenn ChatGPT, Perplexity, Claude oder Googles AI Overviews eine Quelle verlinken, steckt fast immer dasselbe Prinzip dahinter: Retrieval-Augmented Generation (RAG). Das System formuliert aus der Frage eine oder mehrere Suchanfragen, holt passende Dokumente aus einem Suchindex, wählt die relevantesten Passagen aus und lässt das Sprachmodell daraus eine Antwort schreiben. Die Links unter oder in der Antwort sind die Dokumente, auf die sich die Antwort stützt.

Daraus folgt die wichtigste Erkenntnis: Zitiert wird nicht, was das Modell „weiß“, sondern was es in diesem Moment findet. Wissen aus dem Training erscheint meist ohne Link. Wer als Quelle auftauchen will, muss also in den Indizes stehen, die die jeweiligen Systeme abfragen – und dort mit einer gut extrahierbaren Passage überzeugen.

Wer welchen Index nutzt

SystemQuellen / CrawlerWas das für dich heißt
ChatGPT-SucheEigener Crawler OAI-SearchBot; laut OpenAI zusätzlich Drittanbieter-SuchdiensteOAI-SearchBot in der robots.txt erlauben. Ausgesperrte Seiten erscheinen laut OpenAI nicht in Suchantworten (höchstens als Navigationslink).
Google AI Overviews / AI ModeGoogles regulärer Suchindex (Googlebot)Seite muss indexiert und mit Snippet anzeigbar sein. Kein Spezial-Markup nötig.
PerplexityEigener Index über PerplexityBot; Perplexity-User für Abrufe im Auftrag eines NutzersPerplexityBot zulassen. Perplexity-User ignoriert robots.txt laut eigener Doku in der Regel.
ClaudeClaude-SearchBot und Claude-User; Anthropic führt Brave Search als UnterauftragsverarbeiterClaude-SearchBot zulassen. Eine gute Sichtbarkeit in Brave Search schadet vermutlich nicht.
Microsoft CopilotBing-Index (Bingbot)Klassische Bing-Indexierung pflegen, z. B. über Bing Webmaster Tools.

Wie gewichtet wird, ist nicht öffentlich. OpenAI nennt neben dem eigenen Crawler „Drittanbieter-Suchdienste“, ohne die Gewichtung offenzulegen; Microsoft Bing gilt als langjähriger Partner. Dass Claude für die Websuche maßgeblich Brave nutzt, stützt sich auf Anthropics Liste der Unterauftragsverarbeiter und auf unabhängige Auswertungen – nicht auf eine ausführliche offizielle Beschreibung. Plane deshalb breit: Wer bei Google, Bing und den KI-eigenen Crawlern gut erreichbar ist, deckt die meisten Wege ab.

Answer-first schreiben

Ein RAG-System zieht selten ganze Seiten heran, sondern einzelne Abschnitte. Je schneller ein Abschnitt die Frage beantwortet, desto leichter lässt er sich zitieren. Journalisten nennen das umgekehrte Pyramide: das Wichtigste zuerst, Details danach.

So sieht ein zitierfähiger Abschnitt aus

  • Überschrift als Frage oder klare Aussage: „Wie lang sollte ein Title-Tag sein?“ statt „Allgemeines“.
  • Direkt darunter die Antwort in ein bis zwei Sätzen – vollständig verständlich, auch ohne den Rest der Seite. Faustregel: 40 bis 300 Zeichen.
  • Dann die Details: Ausnahmen, Beispiele, Rechenwege, Quellen.
  • Listen und Tabellen für Schritte, Vergleiche und Kennzahlen. Sie lassen sich sauber extrahieren.
  • Ein Thema pro Abschnitt. Mischabschnitte („Preise, Versand und Garantie“) sind schwer zu zitieren.
  • Eindeutige Begriffe: Nenne Produkt- und Firmennamen aus, statt „es“ oder „unser Tool“ zu schreiben – der Abschnitt steht im Zitat ohne Kontext.
Schlecht: „Hier kommt es auf viele Faktoren an, die wir im Folgenden genauer betrachten.“
Besser: „Ein Title-Tag sollte etwa 50 bis 60 Zeichen lang sein, weil Google längere Titel in den Suchergebnissen meist abschneidet.“

Answer-first heißt nicht, Inhalte zu kürzen. Die Tiefe bleibt wichtig – sie gehört nur hinter die Kernantwort, nicht davor.

E-E-A-T sichtbar machen

Google beschreibt Qualität mit E-E-A-T: Experience (eigene Erfahrung), Expertise, Authoritativeness (Autorität) und Trustworthiness (Vertrauenswürdigkeit). Das ist kein einzelner Rankingfaktor, sondern ein Rahmen für Signale, die auch außerhalb von Google für Glaubwürdigkeit stehen. Für KI-Suchen gilt das ebenso: Ein System, das zwischen zwei ähnlichen Passagen wählt, hat mehr Grund, der nachvollziehbaren Quelle zu folgen.

  • Autor nennen: Name, kurze Bio, Qualifikation und Link auf eine Autorenseite. Im Markup als author vom Typ Person.
  • Datum zeigen: Veröffentlichung und letzte inhaltliche Aktualisierung sichtbar und im Markup (datePublished, dateModified).
  • Betreiber erkennbar machen: Impressum, Kontakt, „Über uns“ und Datenschutzerklärung leicht auffindbar verlinken.
  • Erfahrung belegen: Eigene Tests, Fotos, Messwerte, Fallbeispiele – Dinge, die nur du liefern kannst.
  • Entität verknüpfen: Organization mit sameAs auf offizielle Profile. Wie das geht, zeigt der Guide Strukturierte Daten für KI-Suche.

Quellen & Aktualität

Wer Fakten nennt, sollte zeigen, woher sie stammen. Verlinke Primärquellen – Gesetzestexte, Studien, Herstellerdokumentation, amtliche Statistiken – statt Sekundärartikel. Das hilft Lesern, und es macht deine Aussage überprüfbar.

  • Zahlen mit Quelle und Stand: „laut Statistischem Bundesamt, Stand 2025“ statt „Studien zeigen“.
  • Inhalte wirklich aktualisieren: Veraltete Preise, Fristen oder Versionsnummern sind ein häufiger Grund, warum eine Seite gegenüber frischeren Quellen verliert.
  • dateModified ehrlich halten: Nur bei echten Änderungen anpassen. Ein automatisch auf „heute“ gesetztes Datum ohne neue Inhalte ist irreführend und kann Vertrauen kosten.
  • Eigene Daten veröffentlichen: Umfragen, Benchmarks oder Auswertungen, die es nirgendwo sonst gibt, werden besonders gern als Quelle herangezogen – weil es keine Alternative gibt.

Ob KI-Crawler deine Seite lesen dürfen und ob Autor, Datum und strukturierte Daten vorhanden sind, zeigt dir PageScore in wenigen Sekunden.

Website jetzt kostenlos prüfen

Technische Voraussetzungen

Der beste Text wird nicht zitiert, wenn kein System ihn abrufen darf oder lesen kann. Prüfe mindestens diese Punkte:

  • Crawler-Zugriff: Such- und Nutzer-Bots wie OAI-SearchBot, PerplexityBot, Claude-SearchBot, Googlebot und Bingbot dürfen nicht per robots.txt ausgesperrt sein. Trainings-Bots wie GPTBot kannst du getrennt davon blockieren – Details im Guide KI-Crawler in der robots.txt.
  • Kein noindex, kein nosnippet: Für Googles AI Overviews muss eine Seite indexiert sein und mit Snippet angezeigt werden dürfen. nosnippet oder max-snippet:0 schließen sie aus.
  • Inhalte ohne JavaScript: Viele KI-Crawler führen kein oder nur begrenzt JavaScript aus. Wichtiger Text sollte im ausgelieferten HTML stehen, nicht erst clientseitig nachgeladen werden.
  • Firewall und Bot-Schutz: Manche CDN- oder WAF-Regeln blocken KI-Crawler pauschal. OpenAI etwa empfiehlt, zusätzlich zur robots.txt die veröffentlichten IP-Bereiche zuzulassen.

Alle zehn Faktoren im Überblick findest du im GEO Check; wie sich das Ganze von klassischem SEO unterscheidet, erklärt GEO vs. SEO.

Sichtbarkeit messen

Ein „Ranking“ wie in der klassischen Suche gibt es in KI-Antworten nicht – die Antworten variieren je nach Formulierung, Nutzer und Zeitpunkt. Messen lässt sich trotzdem einiges:

Referrer und UTM-Parameter

Klicks aus KI-Antworten tauchen in deiner Webanalyse als Verweise auf, etwa von chatgpt.com, perplexity.ai, gemini.google.com oder copilot.microsoft.com. ChatGPT hängt an Links aus der Suche zusätzlich utm_source=chatgpt.com an. Beides ist unvollständig: Nicht jede App oder jeder Browser überträgt einen Referrer, ein Teil dieser Besuche landet als „Direkt“ in der Statistik.

Google Search Console

Klicks und Impressionen aus AI Overviews und AI Mode zählt Google laut eigener Dokumentation zum normalen Suchtraffic im Suchtyp „Web“. Einen eigenen Filter dafür gibt es nicht – du siehst die Effekte nur indirekt, etwa bei Impressionen ohne entsprechenden Klickanstieg.

Server-Logs

In deinen Access-Logs siehst du, welche Crawler tatsächlich vorbeikommen: OAI-SearchBot, ChatGPT-User, PerplexityBot, Claude-SearchBot, Claude-User und andere. Abrufe durch Nutzer-Bots (ChatGPT-User, Claude-User, Perplexity-User) zeigen, dass jemand im Chat gerade eine deiner Seiten angefordert hat. Achtung: User-Agents lassen sich fälschen; verlässlich ist erst der Abgleich mit den veröffentlichten IP-Bereichen der Anbieter.

Manuelle Prompt-Tests

Lege eine Liste von 10 bis 30 Fragen an, die deine Zielgruppe stellen würde, und prüfe regelmäßig, welche Quellen ChatGPT, Perplexity, Claude und Google nennen. Dokumentiere Datum, Formulierung und Ergebnis. Das ist keine Statistik, zeigt aber Tendenzen und Wettbewerber, die du sonst nicht siehst.

Häufige Fragen

Kann ich dafür bezahlen, in ChatGPT zitiert zu werden?

Für die organischen Quellenangaben in Suchantworten gibt es kein bezahltes Programm. Sichtbar wirst du über Erreichbarkeit für OAI-SearchBot, relevante Inhalte und klare Antworten. Werbeformate, sofern angeboten, sind davon getrennt.

Muss ich GPTBot erlauben, um in ChatGPT zu erscheinen?

Nein. GPTBot sammelt Trainingsdaten. Für die ChatGPT-Suche ist OAI-SearchBot zuständig. Du kannst GPTBot blockieren und OAI-SearchBot erlauben.

Brauche ich besonderes Markup für AI Overviews?

Nein. Google schreibt, dass weder spezielle Dateien noch spezielles Schema.org-Markup nötig sind. Die Seite muss indexiert und mit Snippet anzeigbar sein.

Wie schnell wirken Änderungen an der robots.txt?

OpenAI und Perplexity nennen jeweils rund 24 Stunden, bis Änderungen berücksichtigt werden. Bis eine Seite dann tatsächlich neu gecrawlt und zitiert wird, kann es länger dauern.

Warum wird meine Seite nicht zitiert, obwohl sie bei Google gut rankt?

Mögliche Gründe: Der KI-eigene Crawler ist ausgesperrt, der Inhalt steht erst nach JavaScript-Ausführung im HTML, die Antwort ist tief im Text versteckt oder ein anderes System nutzt einen anderen Index, in dem deine Seite schwächer ist.

Hilft eine llms.txt-Datei beim Zitiertwerden?

Das ist nicht belegt. Keiner der großen Anbieter hat bestätigt, llms.txt für Suchantworten auszuwerten. Die Datei schadet nicht, sollte aber keine Priorität vor Crawler-Zugriff und guten Inhalten haben.