Kurze Antwort

KI mit Suche kann nur zitieren, was ein Crawler lesen und indexieren konnte. Sind deine Seiten nicht im Index, laden sie ihren Inhalt nur per JavaScript, liefern sie Fehler, werden sie durch falsch gesetzte Canonicals dupliziert oder laden sie zu langsam, hilft keine Arbeit an Inhalten oder Quellen. Es ist der am wenigsten glamouröse Teil von GEO und der, der am häufigsten ein „Wir tauchen nicht auf“ erklärt.

Der Fünf-Minuten-Check

  1. Such bei Google nach site:deinedomain.de. Erscheinen deine wichtigen Seiten? Mit den richtigen Titeln?
  2. Öffne die Search Console und sieh dir den Bericht zur Seitenindexierung an. Wie viele Seiten sind ausgeschlossen, und warum?
  3. Öffne eine wichtige Seite mit deaktiviertem JavaScript (oder sieh dir den Quelltext an). Steht der Haupttext da?
  4. Öffne deinedomain.de/robots.txt. Blockierst du etwas, das du nicht blockieren solltest? Über KI-Crawler entscheidest du einzeln.
  5. Miss die Ladezeit auf dem Smartphone. Ist der Inhalt nach wenigen Sekunden da?

Fällt einer dieser Punkte durch, hör hier auf und behebe ihn, bevor du weitermachst.

Die Fehler, die wir am häufigsten sehen

Inhalt nur per JavaScript. Google kann JavaScript verarbeiten, aber in getrennten Phasen und mit mehr Aufwand; andere Crawler können es weniger gut. Steht der wesentliche Text nicht im ursprünglichen HTML, existiert er für viele Systeme nicht. Nutze Prerendering oder statische Generierung für alles, was zitiert werden soll.

Seiten, die ein Canonical ausschließt. Ein Canonical, das auf eine andere URL zeigt, sagt der Suchmaschine: „Indexiere die andere.“ Beantwortet die andere die Frage nicht, hast du deine beste Seite versteckt.

Geerbtes noindex. Aus der Entwicklungsphase, von einem Plugin, aus einer Vorlage. Prüf die Seiten, auf die es ankommt, eine nach der anderen.

Weiterleitungsketten und Soft-404. Eine Seite, die mit Status 200 antwortet und „nicht gefunden“ anzeigt, verwirrt den Index. Ein 404 sollte ein 404 sein.

Sperren im CDN. Anti-Bot-Regeln, die legitimen Crawlern einen 403 zurückgeben. Du siehst sie nur in den Logs.

Duplikate durch Parameter oder Sprachen. Versionen mit und ohne Schrägstrich am Ende, mit und ohne www, in zwei Sprachen ohne hreflang. Jedes Duplikat verteilt die Signale.

Eine veraltete Sitemap. Mit URLs, die es nicht mehr gibt, oder ohne die neuen. Eine Sitemap indexiert nichts von selbst, aber sie hilft beim Entdecken.

Worauf du bei einer kleinen Website für Dienstleistungen achtest

  • Eine selbstreferenzierende kanonische URL pro indexierbarer Seite.
  • Ein eigener, beschreibender Titel und eine eigene Beschreibung für jede Seite.
  • Eine H1, die Leistung und Markt nennt.
  • Haupttext im HTML, nicht in Bildern oder PDFs.
  • Eine Sitemap, eingereicht in der Search Console und in den Bing Webmaster Tools.
  • Eine robots.txt, die öffentliche Seiten und Such-Crawler erlaubt.
  • Echte 404-Fehler für Pfade, die es nicht gibt.
  • Keine nicht notwendigen Cookies vor der Einwilligung, wo das Gesetz es verlangt (das ist kein Crawling, aber danach wirst du ohnehin gefragt).

Wann das „SEO“ ist und wann „GEO“

Es ist dasselbe. Diese Grundlagen dienen der klassischen Suche und der KI-Suche gleichermaßen, weil Systeme mit Suche aus derselben Art von Index abrufen. Deshalb prüft auch eine reine GEO-Agentur Crawling und Indexierung: nicht als SEO-Leistung, sondern als Voraussetzung dafür, dass die Messung Sinn ergibt.