26.08.2026

Worauf schaut ChatGPT, wenn es eine Quelle zitiert?

Ob ChatGPT Sie zitieren kann, entscheiden drei Dinge: der Crawler-Zugang, der Index, auf den es zugreift, und die Quellen, auf die es ohnehin setzt. Nur das Erste ist ein harter Schalter mit einem Herstellersatz dahinter. Diese Folge liest unsere eigene robots.txt vor laufender Kamera — Fehler inklusive.

Worauf schaut ChatGPT, wenn es eine Quelle zitiert?

ChatGPT schaut beim Zitieren auf drei Dinge: ob OAI-SearchBot Ihre Seite crawlen darf, ob Sie in dem Suchindex stehen, auf den es zugreift, und ob Sie auf den Referenz- und Community-Flächen vorkommen, auf die es ohnehin setzt. Nur das Erste ist ein hartes Tor — OpenAI schreibt, dass Seiten, die OAI-SearchBot ausgeschlossen haben, in ChatGPT-Suchantworten nicht erscheinen.

Eine einzige Zeile in einer Datei, die die meisten Betreiber nie geöffnet haben, kann Sie unbemerkt aus ChatGPTs Antworten entfernen. Diese Datei ist die robots.txt, die Textdatei im Wurzelverzeichnis Ihrer Domain, die jedem Crawler sagt, was er abrufen darf. In der Answer Engine Optimization (AEO) — eine Website so bauen, dass KI-Assistenten sie zitieren — ist das die einzige Prüfung, die ein Schalter ist und kein Handwerk. Ihre Texte können hervorragend und Ihr Markup sauber sein: Kommt der Crawler nie an, ist nichts davon in dem Pool, aus dem die Antwort gezogen wird.

Sehen Sie sich die Folge an

What does ChatGPT look at when citing a source?
Unsere eigene robots.txt vor der Kamera — samt der Regel, die still aufhört zu gelten.

Ein Bot schließt Sie heute von ChatGPT aus, der andere trainiert nur ein künftiges Modell — welcher ist welcher?

OAI-SearchBot — und die Prüfung dauert zwei Minuten. Rufen Sie Ihre eigene Domain mit /robots.txt am Ende auf und suchen Sie diesen Namen. OAI-SearchBot ist der Suchcrawler von OpenAI, und OpenAIs eigene Crawler-Dokumentation sagt, dass Seiten, die ihn ausgeschlossen haben, in ChatGPT-Suchantworten nicht gezeigt werden. Und nun der Punkt, den fast alle verwechseln: GPTBot ist ein anderer Bot mit einer anderen Aufgabe. OpenAI beschreibt GPTBot als Crawler für Inhalte, die zum Training ihrer Basismodelle verwendet werden können. GPTBot zu sperren ändert nichts daran, ob ChatGPT Sie heute zitiert — es ändert, ob Ihre Texte in ein künftiges Modell gelangen. Zwei Bots, zwei Fragen. Lesen Sie die Zeile, nicht das Etikett.

Eine benannte Gruppe hebt die Regeln auf, die Sie für alle geschrieben haben

Weil die Spezifikation es so vorsieht. Googles Dokumentation zur Auslegung der robots.txt hält fest, dass für einen bestimmten Crawler nur eine Gruppe gilt: Der Crawler nimmt die Gruppe, deren User-Agent am genauesten auf ihn passt, und ignoriert jede andere. Wenige Zeilen darunter steht der Satz, der still Sichtbarkeit kostet — user-agent-spezifische Gruppen und globale Gruppen werden nicht kombiniert. Was in einer benannten Gruppe steht, ist für diesen Crawler das ganze Gesetz. Wenn Sie je einen „KI-Bots“-Block aus einem Blogbeitrag in eine Datei kopiert haben, in der bereits sorgfältige Regeln standen, lesen Sie nach, was dieser Block enthält — es ist das Einzige, was der Crawler sieht.

Welchen Fehler enthält unsere eigene robots.txt?

Unsere benannten KI-Crawler-Gruppen erben nichts von den Regeln darüber — und wir zeigen das an unserer eigenen Datei, statt eine fremde zu benoten. Prüfung eins besteht sie: Es gibt eine Gruppe für OAI-SearchBot mit Allow. Weiter oben trägt die Sternchen-Gruppe aber unsere eigentlichen Regeln — die 404-Seite nicht crawlen, das Portal nicht crawlen. Keine davon erreicht OAI-SearchBot. In dem Moment, in dem dieser Crawler seine eigene benannte Gruppe bekam, hat er aufgehört, irgendetwas zu erben. Das ist kein Fehler in unserer Datei, das ist die Spezifikation, wie sie geschrieben steht. Hier kostet es uns wenig, weil diese Pfade hinter einem Login liegen — und private Seiten schützt ein Login, niemals eine Zeile in dieser Datei.

Wie viele Crawler in Ihrer Datei zählen wirklich?

Drei von den siebzehn, die wir namentlich führen. Ein Zitat kosten können heute der Suchcrawler von OpenAI, der Crawler von Perplexity und der Suchcrawler von Anthropic. Der Rest ist kein Ballast: GPTBot regelt, ob Ihre Texte in ein künftiges Trainingskorpus gelangen — eine echte Frage, nur eine langsamere. Wenn Ihnen aber jemand Geld dafür berechnet, die Trainings-Bots freizugeben, damit die KI Sie zitiert, zahlen Sie für die falsche Zeile. Beachten Sie außerdem den einen entscheidenden Crawler, den wir bewusst nicht benannt haben: Googlebot bleibt in der Sternchen-Gruppe und folgt damit weiter unseren Regeln — und über Googlebot erreichen Sie den Index, um den es in Prüfung zwei geht.

Bing oder Google — welchen Index zieht ChatGPT heran?

Beide Hälften stimmen, und die meisten Ratgeber liefern nur eine. Hälfte eins: OpenAIs eigene Hilfeseite zur ChatGPT-Suche nennt Partnerschaften mit anderen Suchanbietern und benennt dabei Bing und Shopify. Wir haben diese Seite am 1. August 2026 direkt gelesen, und Bing stand darin — im Bing-Index zu sein ist also keine vergeudete Mühe. Hälfte zwei: Microsoft hat die Bing-Such-APIs im August 2025 eingestellt, und über dieses Jahr hinweg fiel in einem Panel von Profound über tausend Prompts die Überschneidung von ChatGPT mit Bing-Ergebnissen von 26 % auf 8 %, während die Überschneidung mit Google von rund 12 % auf 33 % stieg. In einem öffentlichen Test zitierte ChatGPT sogar eine Seite, die nur in Google indexiert war. Das sind fremde Messungen, und wir reichen sie als Messungen weiter, nicht als Gesetz. Die Anweisung lautet weder „Bing gehorchen“ noch „Bing ignorieren“: Legen Sie das Gewicht zuerst auf Google — serverseitig gerenderte Seiten, eine ehrliche Sitemap, Googlebot nicht gesperrt — und investieren Sie danach die zwanzig kostenlosen Minuten, um dieselbe Sitemap in den Bing Webmaster Tools einzureichen, weil OpenAI Bing weiterhin nennt und es Sie nichts kostet.

Auf welche Quellen stützt sich ChatGPT ohnehin?

Nicht gleichmäßig auf das Web. In einer dieses Jahr veröffentlichten Untersuchung von 600.000 Zitier-Ereignissen in den USA entfiel auf Wikipedia und Reddit zusammen mehr als ein Viertel von allem, was ChatGPT zitierte. Für ein kleines Unternehmen heißt der Zug daher nicht „überall sein“, sondern auf den zwei, drei Referenz- und Community-Flächen korrekt beschrieben zu sein, auf denen Ihre Kategorie tatsächlich diskutiert wird. Und jetzt die Einschränkung, die Sie von uns hören sollen: In einer anderen Messung über mehr als 100 Millionen Zitate brach Reddits Anteil in rund sechs Wochen von etwa 60 % auf etwa 10 % ein. Behandeln Sie den Quellenmix wie Wetter. Die Crawler-Zeile ist Architektur. Bauen Sie auf die Architektur und kleiden Sie sich nach dem Wetter.

Was sagen kostenlose Sichtbarkeits-Tools über den Crawler-Zugang?

Nichts — und das ist eine Lücke in ihrer Aufgabenstellung, keine Kritik an den Werkzeugen. Der AI Visibility Checker von Ahrefs ist wirklich kostenlos, ohne Anmeldung, mit Ergebnis in Sekunden, und der Report dahinter ist echt: KI-Erwähnungen gesamt, Erwähnungen nach Plattform, Top-Themen, meistzitierte Domains, meistzitierte Seiten. Suchen Sie auf dieser Seite nach dem Wort „robots“: null Treffer. Nichts zum Crawler-Zugang, nichts zu OAI-SearchBot, nichts zu GPTBot. Semrush hat dieselbe Form und ist großzügig beim Zugang — drei Durchläufe pro Tag ohne Registrierung — mit einem gut gebauten Report aus Sichtbarkeitswert, Erwähnungen, Zitaten, Plattformabdeckung, meistzitierten Seiten und Wettbewerbsvergleich. Keine dieser Dimensionen ist der Crawler-Zugang. HubSpots Grader braucht für einen einzelnen Lauf kein Konto und liefert einen Sammelwert aus Tonalität, Präsenzqualität, Markenbekanntheit, Share of Voice und Wettbewerbsumfeld. Fünf Dimensionen, keine davon Zugang. Wäre Ihre eine entscheidende Zeile falsch, würden Ihnen alle drei einen niedrigen Wert reichen — und keines würde Ihnen sagen, warum.

Was macht unser eigener Open-Source-Tracker stattdessen?

Er bindet jeden Bot an das, was eine Sperre tatsächlich kostet. aeo-platform ist unser eigener Tracker, kostenlos und quelloffen auf npm, und sein Crawl-Audit meldet keine Anzahl gesperrter Bots. Es kennzeichnet jeden nach Stufe: Suchstufe heißt, eine Sperre entfernt Sie aus den Antworten dieser Engine; Trainingsstufe heißt, es geht ausschließlich um das Trainingskorpus, ohne gemessene Wirkung auf heutige Zitate; Nutzerstufe heißt, der Abruf wird vom Nutzer ausgelöst und ignoriert Ihre Datei ohnehin meist. Zusätzlich verweigert das Werkzeug, Ihnen eine Aufgabe zum Entsperren eines Trainings-Bots zu schreiben. Diese Verweigerung ist das Produkt — ein Tool, das Ihnen fünf dringend wirkende Zugangs-Aufgaben reicht, obwohl nur eine davon ein Zitat verändern kann, verkauft Beschäftigung und keine Sichtbarkeit.

Wo unsere eigene Seite bei dieser Checkliste durchfällt

Bei Prüfung drei, und zwar deutlich. Suchen Sie heute in der Wikipedia nach Webappski, und Sie bekommen null Treffer — wir haben es am 25. August 2026 erneut geprüft. Wir fehlen auf genau der Fläche, auf die ChatGPT am stärksten setzt, und wir können das nicht beheben, indem wir eine Seite über uns selbst schreiben, denn die Wikipedia verlangt zuerst unabhängige Berichterstattung. Diese Prüfung steht auf unserer eigenen Tafel auf Rot und bleibt es eine Weile. Wir zeigen Ihnen das lieber, als Ihnen eine Abkürzung zu verkaufen — und es ist die ehrliche Form dieser Checkliste: Zwei der drei Dinge, auf die ChatGPT schaut, verdient man langsam, und nur das erste ist ein Schalter, den Sie heute Nachmittag umlegen können.

Die vollständige ChatGPT-Checkliste

Fünf Prüfungen in dieser Reihenfolge, die wir für jeden Kunden durchgehen. Erstens: OAI-SearchBot in der robots.txt erlaubt — als einzige der fünf ein Schalter. Zweitens: die benannte Gruppe lesen, die Sie ihm gegeben haben, denn sie erbt nichts von der Gruppe darüber. Drittens: serverseitig gerenderte Seiten im Google-Index und Googlebot nicht gesperrt. Viertens: eine Sitemap in den Bing Webmaster Tools eingereicht, weil OpenAI Bing weiterhin nennt. Fünftens: eine redliche Präsenz auf den zwei, drei Referenz- und Community-Flächen, auf denen Ihre Kategorie diskutiert wird — und kein Vertrauen darauf, dass dieser Mix so bleibt. Die erste Prüfung dauert zwei Minuten, und die meisten Seiten haben nie nachgesehen.

Häufige Fragen

Sollten wir GPTBot sperren?

Das ist eine Entscheidung über Training, nicht über Zitate. OpenAI beschreibt GPTBot als Crawler für Inhalte, die zum Training ihrer Basismodelle dienen können; ihn zu sperren entfernt Sie also nicht aus den heutigen ChatGPT-Antworten — das tut OAI-SearchBot. Sperren Sie GPTBot, wenn Ihre Texte nicht in ein künftiges Modell sollen, und wissen Sie, dass es Ihnen bei der Sichtbarkeit so oder so nichts bringt.

Wir haben einen KI-Bots-Block eingefügt. Ist das unbedenklich?

Nur wenn Sie lesen, was in dem Block steht. Einen Crawler zu benennen erzeugt seine eigene Gruppe, und laut Spezifikation ist das die einzige Gruppe, der dieser Crawler folgt — spezifische und globale Gruppen werden nicht kombiniert. Jede Disallow-Regel aus Ihrer Sternchen-Gruppe gilt für die eben benannten Bots nicht mehr. Lesen Sie den eingefügten Block, als wäre er für diese Crawler Ihre ganze Datei. Genau das ist er.

Müssen wir für ChatGPT-Zitate weiterhin in Bing stehen?

Es hilft weiterhin und ist billig, aber das Gewicht hat sich zu Google verschoben. OpenAIs Hilfeseite nennt Bing nach wie vor als Suchpartner, weshalb eine Sitemap in den Bing Webmaster Tools zwanzig kostenlose Minuten wert ist. Unabhängige Panel-Messungen über 2025 zeigen eine sinkende Überschneidung mit Bing und eine steigende mit Google — stecken Sie die eigentliche Arbeit also zuerst in die Indexierbarkeit bei Google.

Zeigt ein kostenloses Tool, ob ein Crawler gesperrt ist?

Die drei geprüften nicht. Ahrefs, Semrush und HubSpot melden Erwähnungen, zitierte Seiten, Plattformabdeckung und Sammelwerte — nützlich für die Frage, ob Sie vorkommen, stumm zur Frage, warum nicht. Ein gesperrter Suchcrawler und eine langweilige Seite ergeben in diesen Reports denselben niedrigen Wert. Prüfen Sie die robots.txt selbst oder nutzen Sie einen Tracker, dessen Crawl-Audit die Stufe jedes Bots benennt.

Wie kommen wir auf die Quellen, auf die ChatGPT setzt?

Langsam, und indem Sie korrekt beschrieben werden, statt über sich selbst zu publizieren. Die Wikipedia verlangt zuerst unabhängige Berichterstattung, also kommen Presse und echte Fremdtexte vor jedem Enzyklopädie-Eintrag. Auf Community-Flächen gilt: dort präsent sein, wo Ihre Kategorie wirklich besprochen wird, und dort sachlich richtig sein. Behandeln Sie den Mix als instabil — ein gemessener Einbruch brachte Reddits Anteil in rund sechs Wochen von etwa 60 % auf 10 %.

Sollen wir diese fünf Prüfungen auf Ihrer Seite durchgehen?

Wir prüfen alle fünf — Crawler-Zugang, Gruppenvererbung, Index-Abdeckung, Bing-Einreichung und Quellenpräsenz — auf echten Kundenseiten, und die erste KI-Sichtbarkeitsanalyse ist kostenlos. Wenn Sie wissen möchten, ob ChatGPT Sie überhaupt erreichen kann, fordern Sie die kostenlose Analyse unter webappski.com an.

← Zurück zu allen Beiträgen