Réponse rapide : Le 23 septembre 2026, notre sitemap listait 705 URL et Google Search Console en rapportait 7 indexées. Nous avons crawlé chaque page en anglais, construit le graphe de liens internes, et trouvé six défauts. Les corriger a amélioré le site de manière mesurable. Aucun d'eux n'était la raison pour laquelle seulement 7 pages étaient indexées.

La position de départ

URLs dans le sitemap 705
Découvertes par Google 705
Indexées 7
Domaines référents 43

La découverte n'a jamais été le problème. Google avait lu le sitemap ce jour-là et trouvé chaque URL. L'écart entre 705 découvertes et 7 indexées est une décision, pas un problème technique.

Nous avons crawlé les 178 pages en anglais, analysé chacune, et construit le graphe de liens à partir du HTML rendu plutôt que d'un plan de site que nous aurions dessiné nous-mêmes. Six éléments en sont ressortis.

1. Le glossaire était un ensemble de feuilles

Vingt-trois pages de définitions, chacune ciblant un terme principal. Le graphe de liens disait ceci :

pages liant à un terme du glossaire :  { "/glossary": 23 }
blog médian  -> liens vers glossaire : 0
pilier médian -> liens vers glossaire : 0

L'index liait chaque terme. Rien d'autre ne les liait. Dix-huit termes avaient exactement un lien entrant sur tout le domaine ; les cinq autres apparaissaient dans le menu du site, qui est du boilerplate et donc ignoré.

Nous avons lié la première mention de chaque terme défini dans le texte des articles, et donné à chaque terme quatre liens frères en anneau pour que les deux termes qu'aucun article ne mentionne soient également couverts. Les liens dans le contenu vers le glossaire sont passés de 23 à 617, et le terme le moins lié est passé d'un lien entrant à cinq.

2. Cloudflare était devant le site et ne le cachait pas

cache-control:    public, max-age=600, must-revalidate   <- origine demandée
cf-cache-status:  DYNAMIC                                <- Cloudflare refusé

Cloudflare ne met pas en cache le HTML par défaut, peu importe ce que demande l'origine. Il faut une règle de cache explicite. Chacune de ces 705 URL était servie depuis une seule machine à chaque accès, y compris chaque crawl.

Mesuré sur six échantillons, avec le temps de trajet TLS client soustrait pour ne laisser que le temps de réponse : 346 ms depuis l'origine, 186 ms depuis le bord.

3. La plupart du site était publié dans une seule langue

Quarante-neuf guides, seize outils et vingt-trois termes de glossaire sont publiés en sept langues. Quatre-vingt-deux articles de blog et quatre pages commerciales sont publiés dans une seule. Le nombre de hreflang vous indique lesquels sans lire un mot : neuf alternatifs sur une page traduite, un sur une non traduite.

4. Le schéma FAQ sur 59 pages aurait été un travail gaspillé

L'élément évident suivant était les 59 pages sans balisage FAQPage. Vérifier la documentation de Google avant d'en écrire a révélé que la fonctionnalité a été restreinte aux sites gouvernementaux et de santé en septembre 2023 et supprimée de Google Search entièrement en mai 2026.

Le contenu visible de questions-réponses vaut toujours la peine d'être écrit, car les moteurs de réponse le reprennent et les lecteurs l'utilisent. Le schéma seul n'apporte rien dans Google. C'est le type de gain le moins cher disponible lors de tout audit : le travail que vous trouvez une raison de ne pas faire.

5. Nos images ne correspondaient pas à nos pages

Chaque guide comportait une image héro générée, et les images étaient abstraites par règle — la page sur les conseils communautaires montrait un tas de cailloux. Unique et hors sujet reste du remplissage, et cela ne vaut rien dans la recherche d'images, qui lit la page autour de l'image et s'attend à ce que les deux soient en accord. Nous avons réécrit chaque scène pour représenter son sujet et régénéré les 72.

6. La chose qu'aucun des éléments ci-dessus ne corrige

Quarante-trois domaines référents.

Les liens internes augmentent la valeur d'une page qui est crawlée. Le cache de bord rend chaque crawl moins cher. La traduction multiplie les pages adressables. Le schéma rend une page crawlée plus facile à comprendre. Chacun vaut la peine d'être fait et nous les avons faits.

Aucun d'eux ne change la quantité de crawl qu'un domaine reçoit. Cela est déterminé par le nombre de sites indépendants qui le recommandent, et avec 43 domaines référents sur 705 URL, l'allocation est au plafond. Un site techniquement parfait sans liens est un site techniquement parfait que personne ne lit.

Ce que nous dirions à un marchand avec le même symptôme

Si Search Console indique découvert, actuellement non indexé sur la plupart de vos URL :

  1. Vérifiez d'abord qu'il ne s'agit pas d'un problème de duplication. Symptôme différent, correction différente — notre définition de URL canonique couvre la distinction.
  2. Arrêtez d'ajouter des pages. Plus d'URL sur un domaine avec une petite allocation de crawl rend le ratio pire, pas meilleur.
  3. Rendez les pages que vous avez plus faciles à atteindre. Un lien entrant n'est pas suffisant, et un lien de menu n'est pas un lien éditorial.
  4. Gagnez des liens. C'est plus lent et plus difficile que toute correction technique, ce qui est exactement pourquoi la plupart des audits se terminent avant d'y arriver.

Un audit technique gratuit trouvera les trois premiers sur votre boutique en quelques minutes. Le quatrième est le travail.