Konrad Griesser Digitalmarketing – Webdesign für Augsburg

So erreichen Sie uns

Kostenlosen SEO-Check anfordern
SEO, GEO & AEO

Wie ChatGPT, Perplexity und Gemini ihre Quellen auswählen

KI-Assistenten suchen im Hintergrund im Web und wählen wenige Passagen aus. Was über diese Auswahl bekannt ist — und was nicht.

Wie ChatGPT, Perplexity und Gemini ihre Quellen auswählen

ChatGPT, Perplexity und Gemini wählen ihre Quellen in zwei Schritten aus: Zuerst holt eine klassische Websuche im Hintergrund eine Reihe von Kandidatenseiten, danach entscheidet das Sprachmodell, welche Textpassagen daraus tatsächlich in die Antwort einfließen. Die genauen Kriterien legt kein Anbieter offen. Was sich beobachten und aus der Funktionsweise ableiten lässt, reicht trotzdem für eine klare Arbeitsgrundlage.

Das Grundprinzip: erst suchen, dann formulieren

Sobald eine Anfrage aktuelle oder spezifische Informationen verlangt, arbeiten alle großen Assistenten nach dem RAG-Prinzip (Retrieval-Augmented Generation). Der Ablauf sieht vereinfacht so aus:

  1. Das System zerlegt Ihre Frage in eine oder mehrere Suchanfragen. Aus „Welcher Steuerberater in Augsburg kennt sich mit Photovoltaik aus?“ werden intern mehrere kürzere Suchen.
  2. Ein Suchindex liefert dazu Treffer. Das ist ein herkömmlicher Websuchindex, kein magisches KI-Gedächtnis.
  3. Die aussichtsreichsten Seiten werden abgerufen und in Abschnitte zerlegt.
  4. Das Modell bewertet, welche Abschnitte zur Frage passen, und formuliert daraus die Antwort — meist mit Quellenangabe.

Daraus folgt die wichtigste Erkenntnis für die Praxis: Ohne Auffindbarkeit in der zugrunde liegenden Suche gibt es keine Nennung. Eine Seite, die in keinem Index vernünftig vertreten ist, kommt im zweiten Schritt gar nicht erst an. Deshalb ist solides SEO die Eintrittskarte und nicht der überholte Vorgänger.

Wo sich die Systeme unterscheiden

ChatGPT entscheidet selbst, ob es für eine Frage im Web sucht oder aus dem Trainingswissen antwortet. Für die Suche nutzt OpenAI einen eigenen Crawler, den OAI-SearchBot, und greift nach eigenen Angaben zusätzlich auf Suchpartner zurück. Ruft ChatGPT eine Seite während eines Gesprächs direkt ab, geschieht das über den Agenten ChatGPT-User. Der bekanntere GPTBot sammelt dagegen Trainingsdaten und hat mit der Live-Suche nichts zu tun.

Perplexity ist von Grund auf als Antwortmaschine mit Quellenangaben gebaut. Es sucht praktisch bei jeder Anfrage, betreibt mit dem PerplexityBot einen eigenen Index und zeigt seine Quellen prominent an.

Gemini und Googles KI-Antworten in der Suche stützen sich auf den Google-Index. Google beschreibt dafür ein Verfahren, bei dem eine Frage in viele Teilfragen aufgefächert wird, die parallel gesucht werden. Wer bei Google zu einem Thema breit und gut vertreten ist, hat hier einen Startvorteil. Copilot wiederum baut auf dem Bing-Index auf — ein guter Grund, die Bing Webmaster Tools nicht länger zu ignorieren.

Was eine Passage zitierfähig macht

Im zweiten Schritt wird nicht die Seite als Ganzes bewertet, sondern einzelne Abschnitte. Aus unseren Tests und aus der Logik des Verfahrens ergeben sich Merkmale, die die Chancen erkennbar verbessern:

  • Direkte Antwort: Der Abschnitt beantwortet eine konkrete Frage in den ersten ein bis zwei Sätzen.
  • Eigenständigkeit: Der Absatz ist ohne den Rest der Seite verständlich. Formulierungen wie „wie oben beschrieben“ oder unklare Bezüge machen ihn unbrauchbar.
  • Konkrete Angaben: Zahlen mit Einheit, Zeiträume, Voraussetzungen, klare Abgrenzungen. Vage Werbesprache liefert dem Modell nichts, was es übernehmen könnte.
  • Erkennbarer Absender: Autor, Unternehmen, Datum und Impressum sind vorhanden und plausibel.
  • Technische Lesbarkeit: Der Text steht im ausgelieferten HTML. Viele KI-Crawler führen nach allem, was sich beobachten lässt, kein JavaScript aus.
  • Aktualität: Bei Themen, die sich ändern, haben erkennbar gepflegte Seiten Vorteile.

Wie man Texte nach diesen Kriterien aufbaut, gehört zum Kern unserer Arbeit in der Answer Engine Optimization.

Die Rolle von Marke und Entität

Neben der Live-Recherche wirkt das Trainingswissen. Ein Modell, das den Namen eines Unternehmens schon aus vielen Zusammenhängen kennt — Branchenportale, Presse, Verbandsseiten, Bewertungen —, ordnet es sicherer ein und nennt es eher, wenn eine Empfehlung gefragt ist. Entscheidend ist dabei Konsistenz. Tritt ein Hotel im Allgäu an fünf Stellen im Netz mit drei verschiedenen Schreibweisen und zwei Adressen auf, entsteht aus Sicht der Maschine kein klares Bild, sondern Rauschen.

Strukturierte Daten helfen, dieses Bild zu schärfen: Organisation, Standort, Leistungen und Verweise auf die eigenen Profile lassen sich eindeutig auszeichnen. Ob und wie stark Sprachmodelle diese Auszeichnung direkt auswerten, ist nicht abschließend geklärt. Sicher ist, dass die Suchindizes im Hintergrund sie verwenden — und über die läuft die Vorauswahl.

Was niemand sicher weiß

Ich halte es für wichtig, die Grenzen klar zu benennen. Unbekannt ist, wie die Systeme Quellen gegeneinander gewichten, ob es feste Listen bevorzugter Domains gibt und wie stark Nutzersignale einfließen. Bekannt ist außerdem, dass dieselbe Frage zu verschiedenen Zeitpunkten unterschiedliche Quellen hervorbringt. Einzelne Testabfragen beweisen deshalb wenig. Aussagekräftig wird es erst, wenn man viele Fragen über längere Zeit beobachtet.

Meine Faustregel: Optimieren Sie für das, was sich aus der Funktionsweise logisch ergibt — nicht für das, was jemand in einem Einzeltest zufällig gesehen hat.

Kurz beantwortet

Nutzen KI-Assistenten einfach die Google-Ergebnisse?

Nur teilweise. Gemini und Googles KI-Antworten stützen sich auf den Google-Index, Copilot auf Bing, ChatGPT und Perplexity auf eigene Crawler und Partner. Gemeinsam ist allen, dass eine herkömmliche Websuche die Vorauswahl trifft.

Warum nennt ChatGPT meinen Wettbewerber und nicht mich?

Meist, weil der Wettbewerber zu genau dieser Frage eine klarere, besser auffindbare Passage bietet oder im Netz häufiger und einheitlicher erwähnt wird. Eine Analyse der zitierten Quellen zeigt in der Regel schnell, woran es liegt.

Kann ich bei den Anbietern eine Aufnahme beantragen?

Nein, ein Anmeldeverfahren gibt es nicht. Sie können lediglich dafür sorgen, dass die jeweiligen Crawler Zugriff haben und Ihre Seite in Google und Bing sauber indexiert ist.

Konrad Griesser

Konrad Griesser

SEO-, GEO- & AEO-Berater aus Augsburg — im Web zuhause seit 1999. Mehr über SEO Genie

Weiterlesen

Ähnliche Beiträge

Lieber umsetzen lassen?

SEO, GEO und AEO aus einer Hand — für Unternehmen in ganz Bayern.

Website kostenlos prüfen