Réponse rapide : effectuez ces 20 vérifications dans l'ordre des couches — l'indexabilité d'abord (un noindex accidentel l'emporte sur tout le reste), puis la clarté de l'exploration, le rendu, la performance, les données structurées et la couche des robots d'IA. Chaque vérification ci-dessous a une condition de réussite que vous pouvez vérifier vous-même, la plupart avec des outils gratuits. Passage complet trimestriel ; passage ciblé après chaque changement de thème, replatforming ou modification en masse.
L'ordre est la méthode : chaque couche conditionne celles en dessous. Un schéma parfait sur une page noindexée est de la décoration. Travaillez de haut en bas et arrêtez de peaufiner les couches inférieures tant qu'une couche supérieure échoue.
| Ordre | Couche | Première chose à vérifier |
|---|---|---|
| 1 | Indexabilité | Aucun noindex accidentel (Vérification 1) |
| 2 | Clarté de l'exploration | Canonical auto-référencé (Vérification 5) |
| 3 | Rendu | Contenu en HTML brut (Vérification 10) |
| 4 | Performance | Passage des Core Web Vitals (Vérification 12) |
| 5 | Données structurées | Validation du schéma (Vérification 15) |
| 6 | Couche des robots d'IA | Robots d'IA autorisés dans robots.txt (Vérification 17) |
Couche 1 — Indexabilité (vérifications 1–4)
- Aucun noindex accidentel. Affichez le code source (ou simulez Googlebot) sur vos pages importantes : pas de méta robots ou de X-Robots-Tag contenant noindex. Le bug technique qui peut ruiner une carrière ; se produit constamment via les mises à jour de thème et les déploiements en staging. (Ce que signifient les directives.)
- Les pages clés renvoient 200. Pas de chaînes 302, pas de modèles soft-404. Redirections maximum un saut.
- robots.txt ne bloque rien qui devrait être classé. Une page bloquée ne peut pas non plus montrer son noindex — le blocage et la désindexation sont des tâches différentes (guide des robots ; générateur).
- Search Console montre les pages indexées. Rapport des pages → vos URL importantes dans "Indexées", et chaque raison d'exclusion sur ce rapport expliquée, pas ignorée. (Configuration GSC.)
Couche 2 — Clarté de l'exploration (vérifications 5–9)
- Un canonical auto-référencé par page ; les variantes et paramètres se canonisent à l'URL propre (mécanismes de contenu dupliqué).
- Sitemap complet et propre — chaque page indexable incluse, chaque page redirigée/404/noindexée exclue, soumise dans GSC (guide du sitemap).
- Pas de pages orphelines — tout ce qui est important est accessible par des liens internes, idéalement à trois clics de la page d'accueil.
- Hygiène des redirections — pas de chaînes au-delà d'un saut, pas de boucles, et chaque URL retirée avec des liens entrants redirige en 301 vers un endroit pertinent (réclamation).
- hreflang correct si multilingue — paires bidirectionnelles, x-default, auto-inclusion (guide hreflang).
Couche 3 — Rendu (vérifications 10–11)
- Le contenu existe en HTML brut. Récupérez n'importe quelle page clé comme Googlebot : titre, H1, texte du corps et informations produit présents sans JavaScript. Si la récupération brute est une coquille, Google vous indexe lentement et les robots d'IA pas du tout (correctifs SPA).
- Un seul H1, arborescence de titres cohérente, liens HTML réels (balises d'ancrage, pas de gestionnaires de clics JS) pour tout ce que les robots doivent suivre.
Couche 4 — Performance (vérifications 12–14)
- Passage des Core Web Vitals sur les données terrain — LCP < 2,5s, INP < 200ms, CLS < 0,1, dans la section utilisateur réel de PageSpeed Insights, mobile d'abord.
- Images dimensionnées et compressées — formats modernes, dimensions déclarées (c'est la plupart du CLS), chargement différé uniquement en dessous de la ligne de flottaison.
- HTTPS partout — un seul schéma+hébergeur canonique, variantes http et www redirigeant en 301 vers celui-ci.
Couche 5 — Données structurées (vérifications 15–16)
- Schéma sur chaque modèle qui le permet — Product+Offer sur les produits, Article sur les articles, BreadcrumbList sur tout le site, Organization une fois — et validation dans le Rich Results Test (guide du schéma).
- Le schéma correspond à la page visible. Prix, disponibilité, évaluations en JSON-LD identiques à ce que voient les humains ; les divergences entraînent des actions manuelles.
Couche 6 — La couche des robots d'IA (vérifications 17–20)
- Robots d'IA explicitement autorisés dans robots.txt — GPTBot, OAI-SearchBot, ClaudeBot, PerplexityBot, Google-Extended — en supposant que vous souhaitez exister dans les réponses d'IA (la décision, argumentée).
- llms.txt publié à la racine, listant vos pages citables (générateur + guide).
- Réponses extraites du HTML brut — les pages clés commencent par une réponse directe en deux phrases ; les blocs FAQ portent le schéma FAQPage (la discipline AEO).
- Vérifiez que les moteurs d'IA peuvent réellement vous récupérer — une récupération Googlebot-UA renvoyant une page de défi CDN au lieu du contenu signifie que votre protection contre les robots nuit également à votre visibilité IA.
Exécution réelle
Manuellement, le passage prend un après-midi avec la pile gratuite : GSC + le simulateur + PSI + Rich Results Test. À l'échelle du catalogue, les vérifications sont la moitié facile et les centaines de corrections par page sont le mur — c'est la moitié que RankEngine automatise pour Shopify : il effectue ces vérifications sur chaque produit, collection et page en continu, puis applique et vérifie les corrections via l'API. Dans tous les cas, la discipline est la même : auditez lors des changements, surveillez toujours, et ne peaufinez jamais la couche 5 tant que la couche 1 saigne.