Kort antwoord: voer deze 20 controles uit in laagvolgorde — eerst indexeerbaarheid (één toevallige noindex weegt zwaarder dan alles), dan crawl-duidelijkheid, rendering, prestaties, gestructureerde gegevens en de AI-crawlerlaag. Elke controle hieronder heeft een voorwaarde die je zelf kunt verifiëren, de meeste met gratis tools. Elk kwartaal een volledige controle; gerichte controle na elke themawijziging, herplatforming of bulkbewerking.
De volgorde is de methode: elke laag blokkeert de lagen eronder. Een perfect schema op een noindex-pagina is decoratie. Werk van boven naar beneden en stop met het polijsten van lagere lagen terwijl een hogere faalt.
| Volgorde | Laag | Eerste te verifiëren punt |
|---|---|---|
| 1 | Indexeerbaarheid | Geen toevallige noindex (Controle 1) |
| 2 | Crawl-duidelijkheid | Zelfverwijzende canonieke tag (Controle 5) |
| 3 | Rendering | Inhoud in ruwe HTML (Controle 10) |
| 4 | Prestaties | Core Web Vitals geslaagd (Controle 12) |
| 5 | Gestructureerde gegevens | Validerend schema (Controle 15) |
| 6 | AI-crawlerlaag | AI-bots toegestaan in robots.txt (Controle 17) |
Laag 1 — Indexeerbaarheid (controles 1–4)
- Geen toevallige noindex. Bekijk de bron (of fetch als Googlebot) op je belangrijke pagina's: geen robots meta of X-Robots-Tag met noindex. De carrière-beëindigende technische bug; komt constant voor via thema-updates en staging-pushes. (Wat de richtlijnen betekenen.)
- Belangrijke pagina's geven 200 terug. Geen 302-ketens, geen soft-404-sjablonen. Redirects maximaal één sprong.
- robots.txt blokkeert niets dat zou moeten ranken. Een geblokkeerde pagina kan zijn noindex ook niet tonen — blokkeren en deindexeren zijn verschillende taken (robots-gids; generator).
- Search Console toont de geïndexeerde pagina's. Pagina's rapporteren → je belangrijke URL's in "Geïndexeerd", en elke uitsluitingsreden in dat rapport uitgelegd, niet genegeerd. (GSC-instelling.)
Laag 2 — Crawl-duidelijkheid (controles 5–9)
- Eén zelfverwijzende canonieke tag per pagina; varianten en parameters canoniseren naar de schone URL (mechanica van dubbele inhoud).
- Sitemap compleet en schoon — elke indexeerbare pagina erin, elke redirect/404/noindex-pagina eruit, ingediend in GSC (sitemap-gids).
- Geen verweesde pagina's — alles belangrijk bereikbaar via interne links, idealiter binnen drie klikken van de startpagina.
- Redirect-hygiëne — geen ketens voorbij één sprong, geen lussen, en elke gepensioneerde URL met inkomende links 301's naar iets relevants (terugwinning).
- hreflang correct indien meertalig — bidirectionele paren, x-default, zelf-inclusie (hreflang-gids).
Laag 3 — Rendering (controles 10–11)
- Inhoud bestaat in ruwe HTML. Haal een belangrijke pagina op als Googlebot: titel, H1, bodytekst en productinformatie aanwezig zonder JavaScript. Als de ruwe fetch een shell is, indexeert Google je langzaam en AI-crawlers helemaal niet (SPA-oplossingen).
- Eén H1, logische kopstructuur, echte HTML-links (anker-tags, geen JS-clickhandlers) voor alles wat crawlers moeten volgen.
Laag 4 — Prestaties (controles 12–14)
- Core Web Vitals geslaagd op veldgegevens — LCP < 2,5s, INP < 200ms, CLS < 0,1, in het echte-gebruikersgedeelte van PageSpeed Insights, mobiel eerst.
- Afbeeldingen op maat en gecomprimeerd — moderne formaten, afmetingen opgegeven (dat is de meeste CLS), lazy-loading alleen onder de vouw.
- HTTPS overal — één canoniek schema+host, http- en www-varianten 301'en erin.
Laag 5 — Gestructureerde gegevens (controles 15–16)
- Schema op elke sjabloon die in aanmerking komt — Product+Aanbieding op producten, Artikel op berichten, BreadcrumbList sitewide, Organisatie één keer — en validerend in de Rich Results Test (schema-gids).
- Schema komt overeen met de zichtbare pagina. Prijzen, beschikbaarheid, beoordelingen in JSON-LD identiek aan wat mensen zien; afwijking leidt tot handmatige acties.
Laag 6 — De AI-crawlerlaag (controles 17–20)
- AI-crawlers expliciet toegestaan in robots.txt — GPTBot, OAI-SearchBot, ClaudeBot, PerplexityBot, Google-Extended — ervan uitgaande dat je in AI-antwoorden wilt bestaan (de beslissing, beargumenteerd).
- llms.txt gepubliceerd op de root, met een lijst van je citeerbare pagina's (generator + gids).
- Antwoorden op te halen uit ruwe HTML — belangrijke pagina's beginnen met een direct antwoord van twee zinnen; FAQ-blokken dragen FAQPage-schema (de AEO-discipline).
- Verifieer dat de AI-engines je daadwerkelijk kunnen ophalen — een Googlebot-UA-ophaal die een CDN-uitdagingpagina in plaats van inhoud retourneert, betekent dat je botbescherming ook je AI-zichtbaarheid opeet.
Het echt uitvoeren
Handmatig kost de controle een middag met de gratis stack: GSC + de simulator + PSI + Rich Results Test. Op catalogusschaal zijn de controles de gemakkelijke helft en de honderden per-pagina-fixes de muur — wat de helft is die RankEngine automatiseert voor Shopify: het voert deze controles uit over elk product, elke collectie en elke pagina continu, en past de fixes toe en verifieert ze via de API. Hoe dan ook, de discipline is hetzelfde: audit bij verandering, monitor altijd, en polijst nooit laag 5 terwijl laag 1 bloedt.