Kurzantwort: Führen Sie diese 20 Prüfungen in Schichtenreihenfolge durch — zuerst die Indexierbarkeit (ein versehentliches noindex überwiegt alles andere), dann die Crawl-Klarheit, das Rendering, die Leistung, die strukturierten Daten und die KI-Crawler-Schicht. Jede untenstehende Prüfung hat eine Bedingung, die Sie selbst überprüfen können, die meisten mit kostenlosen Tools. Vierteljährlich vollständiger Durchlauf; gezielter Durchlauf nach jeder Themenänderung, Replatforming oder Massenbearbeitung.
Die Reihenfolge ist die Methode: Jede Schicht blockiert die darunterliegenden. Ein perfektes Schema auf einer noindexierten Seite ist Dekoration. Arbeiten Sie von oben nach unten und hören Sie auf, die unteren Schichten zu polieren, während eine obere fehlschlägt.
| Reihenfolge | Schicht | Erstes zu überprüfendes Element |
|---|---|---|
| 1 | Indexierbarkeit | Kein versehentliches noindex (Prüfung 1) |
| 2 | Crawl-Klarheit | Selbstreferenzierendes Canonical (Prüfung 5) |
| 3 | Rendering | Inhalt im Roh-HTML (Prüfung 10) |
| 4 | Leistung | Core Web Vitals bestehen (Prüfung 12) |
| 5 | Strukturierte Daten | Schema validieren (Prüfung 15) |
| 6 | KI-Crawler-Schicht | KI-Bots in robots.txt erlaubt (Prüfung 17) |
Schicht 1 — Indexierbarkeit (Prüfungen 1–4)
- Kein versehentliches noindex. Quelltext anzeigen (oder als Googlebot abrufen) auf Ihren wichtigen Seiten: kein robots-Meta oder X-Robots-Tag mit noindex. Der karrierebeendende technische Fehler; wird ständig durch Themen-Updates und Staging-Pushes ausgeliefert. (Was die Direktiven bedeuten.)
- Wichtige Seiten geben 200 zurück. Keine 302-Ketten, keine Soft-404-Vorlagen. Weiterleitungen maximal ein Sprung.
- robots.txt blockiert nichts, was ranken sollte. Eine blockierte Seite kann ihr noindex auch nicht anzeigen — Blockieren und Deindexieren sind unterschiedliche Aufgaben (robots-Anleitung; Generator).
- Search Console zeigt die indexierten Seiten. Seitenbericht → Ihre wichtigen URLs in "Indexiert", und jeder Ausschlussgrund in diesem Bericht erklärt, nicht ignoriert. (GSC-Einrichtung.)
Schicht 2 — Crawl-Klarheit (Prüfungen 5–9)
- Ein selbstreferenzierendes Canonical pro Seite; Varianten und Parameter kanonisieren zur sauberen URL (Mechanik doppelter Inhalte).
- Sitemap vollständig und sauber — jede indexierbare Seite drin, jede Weiterleitungs-/404-/noindexierte Seite raus, in GSC eingereicht (Sitemap-Anleitung).
- Keine Waisenseiten — alles Wichtige über interne Links erreichbar, idealerweise innerhalb von drei Klicks von der Startseite.
- Weiterleitungshygiene — keine Ketten über einen Sprung hinaus, keine Schleifen, und jede zurückgezogene URL mit eingehenden Links 301s irgendwo relevant (Reklamation).
- hreflang korrekt, wenn mehrsprachig — bidirektionale Paare, x-default, Selbstinklusion (hreflang-Anleitung).
Schicht 3 — Rendering (Prüfungen 10–11)
- Inhalt existiert im Roh-HTML. Abrufen einer beliebigen wichtigen Seite als Googlebot: Titel, H1, Fließtext und Produktinformationen ohne JavaScript vorhanden. Wenn der Rohabruf eine Hülle ist, indexiert Google Sie langsam und KI-Crawler gar nicht (SPA-Lösungen).
- Ein H1, vernünftige Überschriftenstruktur, echte HTML-Links (Ankertags, keine JS-Klick-Handler) für alles, was Crawler folgen sollten.
Schicht 4 — Leistung (Prüfungen 12–14)
- Core Web Vitals bestehen auf Felddaten — LCP < 2,5s, INP < 200ms, CLS < 0,1, im Abschnitt für reale Nutzer von PageSpeed Insights, mobil zuerst.
- Bilder in Größe und Kompression angepasst — moderne Formate, deklarierte Dimensionen (das ist der meiste CLS), Lazy-Loading nur unterhalb der Falte.
- HTTPS überall — ein kanonisches Schema+Host, http- und www-Varianten 301en darauf.
Schicht 5 — Strukturierte Daten (Prüfungen 15–16)
- Schema auf jeder Vorlage, die qualifiziert ist — Produkt+Angebot auf Produkten, Artikel auf Beiträgen, BreadcrumbList sitewide, Organisation einmal — und validieren im Rich Results Test (Schema-Anleitung).
- Schema entspricht der sichtbaren Seite. Preise, Verfügbarkeit, Bewertungen in JSON-LD identisch mit dem, was Menschen sehen; Abweichungen führen zu manuellen Maßnahmen.
Schicht 6 — Die KI-Crawler-Schicht (Prüfungen 17–20)
- KI-Crawler ausdrücklich erlaubt in robots.txt — GPTBot, OAI-SearchBot, ClaudeBot, PerplexityBot, Google-Extended — vorausgesetzt, Sie möchten in KI-Antworten existieren (die Entscheidung, argumentiert).
- llms.txt veröffentlicht im Root-Verzeichnis, listet Ihre zitierbaren Seiten auf (Generator + Anleitung).
- Antworten aus Roh-HTML entnehmbar — wichtige Seiten beginnen mit einer direkten Zwei-Satz-Antwort; FAQ-Blöcke tragen FAQPage-Schema (die AEO-Disziplin).
- Überprüfen, ob die KI-Engines Sie tatsächlich abrufen können — ein Googlebot-UA-Abruf, der eine CDN-Herausforderungsseite anstelle von Inhalten zurückgibt, bedeutet, dass Ihr Bot-Schutz auch Ihre KI-Sichtbarkeit frisst.
In der Praxis
Manuell dauert der Durchlauf einen Nachmittag mit dem kostenlosen Stack: GSC + der Simulator + PSI + Rich Results Test. Im Katalogmaßstab sind die Prüfungen die einfache Hälfte und die Hunderte von pro-Seite-Korrekturen die Mauer — was die Hälfte ist, die RankEngine für Shopify automatisiert: Es führt diese Prüfungen kontinuierlich über jedes Produkt, jede Kollektion und jede Seite durch und wendet die Korrekturen an und überprüft sie über die API. So oder so, die Disziplin ist dieselbe: Audit bei Änderung, immer überwachen und niemals Schicht 5 polieren, während Schicht 1 blutet.