In diesem Artikel 5
Kurze Antwort
Eine KI-Antwort kann aus zwei Richtungen kommen. Aus dem, was das Modell im Training gelernt hat: Das zitiert nichts, weil sich das Modell nicht „erinnert“, woher es etwas weiß. Oder aus einer Live-Suche, bei der die Plattform Seiten aus dem Web abruft, liest und eine Antwort erzeugt, die einige davon zitiert. Nur der zweite Weg zeigt Quellen, und an ihm kannst du arbeiten: Die zitierten Seiten sind crawlbar, klar und im Moment der Anfrage für die Frage relevant.
Zwei Mechanismen, zwei Verhaltensweisen
Ohne Suche. Das Modell antwortet mit dem, was es gelernt hat. War dein Unternehmen im Web nicht relevant, als das Modell trainiert wurde, existierst du für dieses Modell nicht. Es gibt keine Quellen und keine Möglichkeit, es zu „aktualisieren“, bis eine neue Version erscheint.
Mit Suche. ChatGPT mit Suche, Perplexity, Gemini mit Webzugriff, die AI Overviews und der AI Mode von Google (in der deutschen Oberfläche „Übersicht mit KI“ und „KI-Modus“), Copilot. Die Plattform fragt einen Index ab, ruft Dokumente ab, und das Modell schreibt mit ihnen. Hier gibt es Quellen, und sie ändern sich, wenn sich die Seiten ändern.
Notiere beim Messen immer, ob die Suche aktiviert war. Eine Antwort mit Suche und eine ohne zu vergleichen heißt, zwei verschiedene Produkte zu vergleichen.
Wer was crawlt
Jede Plattform hat Crawler für verschiedene Zwecke. Für das Erscheinen zählen die Such-Crawler:
| Plattform | Such-Crawler | Trainings-Crawler | Hinweis |
|---|---|---|---|
| ChatGPT | OAI-SearchBot | GPTBot | ChatGPT-User ruft Seiten ab, wenn ein Nutzer darum bittet, und die robots.txt gilt dafür womöglich nicht |
| Perplexity | PerplexityBot | (laut Dokumentation nicht für das Training genutzt) | Perplexity-User handelt auf Anfrage eines Nutzers |
| Claude | Claude-SearchBot | ClaudeBot | Claude-User handelt auf Anfrage eines Nutzers |
| Google (AI Overviews, AI Mode) | Googlebot | Google-Extended steuert die Nutzung für Gemini und wirkt sich nicht auf die Aufnahme in die Google-Suche aus | Kein besonderes Markup nötig |
Namen und Verhalten ändern sich; die Quellen am Ende dieses Artikels sind die offiziellen Seiten.
Welche Seiten zitiert werden
Wenn wir die Quellen der Antworten auf Kauffragen in Spanien speichern, wiederholen sich dieselben Seitentypen. Eine veröffentlichte Studie ist das noch nicht, nimm es also als Beobachtung aus unserer Arbeit, nicht als Marktdaten:
- Vergleiche und Listen nach dem Muster „die besten X für Y“;
- Preisseiten und Seiten zur Frage „Was kostet das?“;
- häufige Fragen und Ratgeber zur Auswahl;
- Verzeichnisse und Unternehmenseinträge;
- Community-Threads, in denen jemand dasselbe fragt;
- Fachmedien und Pressemitteilungen;
- offizielle Dokumentation und Seiten von Institutionen.
Selten eine Startseite. Fast nie eine allgemeine Seite „Über uns“.
Ein Zitat ist keine Ursache
Erscheint eine Seite als Quelle neben einer Antwort, heißt das: Die Plattform hat sie abgerufen und für diese Frage an diesem Tag als nützlich eingestuft. Es heißt nicht, dass die Seite die Erwähnung einer Marke „verursacht“ hat, dass die Plattform sie immer nutzt oder dass sie sie morgen nutzen wird. Mit zwei Runden im Abstand von einer Woche siehst du, dass auch die Quellen schwanken.
Was du damit anfängst
- Miss zwölf Kauffragen auf zwei Plattformen mit Suche und speichere die zitierten Domains.
- Zähl, welche Domains sich wiederholen. Das ist deine Liste der Quellen, die in deiner Kategorie zählen.
- Prüf für jede davon deine Präsenz: ein korrekter Eintrag, aktuelle Angaben, eine echte Identität.
- Bei den Fragen, bei denen eine Preisseite oder ein Vergleich als Quelle erscheint: Prüf, ob deine Website diese Seite hat.
- Lass die Such-Crawler herein, die dir wichtig sind; über die Trainings-Crawler entscheidest du getrennt.