Resposta rápida: executa estas 20 comprobacións por orde de capas: primeiro a indexación (unha falta de índice accidental supera todo o demais), despois a claridade da rastrexación, a renderización, o rendemento, os datos estruturados e a capa da rastrexadora de IA. Cada comprobación que aparece a continuación ten unha condición de aprobación que podes verificar ti mesmo, a maioría con ferramentas gratuítas. Aprobación completa trimestral; aprobación específica despois de cada cambio de tema, replataforma ou edición masiva.

A ordenación é o método: cada capa limita as capas inferiores. Un esquema perfecto nunha páxina sen indexación é a decoración. Traballa de arriba a abaixo e deixa de pulir as capas inferiores mentres falla unha superior.

Capa 1: Indexabilidade (comprobacións 1–4)

  1. Sen noindex accidental. Ver código fonte (ou buscar como Googlebot ) nas túas páxinas de diñeiro: non hai metadatos de robots nin etiquetas X-Robots que conteñan noindex. O erro técnico que pon fin á carreira; envíase constantemente a través de actualizacións de temas e pushs de proba. ( Que significan as directivas ).
  2. As páxinas clave devolven 200. Non cadeas 302, nin modelos soft-404. Redirecciona como máximo un salto.
  3. robots.txt non bloquea nada que debería posicionarse. Unha páxina bloqueada tampouco pode mostrar o seu noindex: bloquear e desindexar son tarefas diferentes ( guía de robots ; xerador ).
  4. Search Console mostra as páxinas indexadas. Informe de páxinas → as URL do teu diñeiro en "Indexadas" e cada motivo de exclusión nese informe explicado, non ignorado. ( Configuración de GSC .)

Capa 2: claridade da exploración (comprobacións 5–9)

  1. Unha canónica autorreferenciada por páxina ; as variantes e os parámetros canonizanse no URL limpo ( mecánica de contido duplicado ).
  2. Mapa do sitio completo e limpo : todas as páxinas indexables de entrada, todas as páxinas redireccionadas/404/noindexed de saída, enviadas en GSC ( guía do mapa do sitio ).
  3. Sen páxinas orfas : todo o importante está accesible mediante ligazóns internas, idealmente a tres clics da páxina de inicio.
  4. Hixiene de redirección : sen cadeas despois dun salto, sen bucles e cada URL retirada con ligazóns entrantes 301 nalgún lugar relevante ( recuperación ).
  5. hreflang correcto se é multilingüe : pares bidireccionais, predeterminado por x, autoinclusión ( guía de hreflang ).

Capa 3: Renderización (comprobacións 10–11)

  1. O contido existe en HTML bruto. Obtén calquera páxina clave como Googlebot : título, H1, corpo de texto e información do produto presentes sen JavaScript. Se a busca bruta é un shell, Google indexa a páxina lentamente e os rastreadores de IA non o farán en absoluto ( correccións SPA ).
  2. Un H1, unha árbore de títulos sensata, ligazóns HTML reais (etiquetas de ancoraxe, non xestores de clics JS) para calquera cousa que os rastreadores deban seguir.

Capa 4: rendemento (comprobacións 12–14)

  1. Os datos vitais web principais transmiten datos de campo : LCP < 2,5 s, INP < 200 ms, CLS < 0,1, na sección de usuario real de PageSpeed Insights, primeiro para móbiles.
  2. Imaxes dimensionadas e comprimidas : formatos modernos, dimensións declaradas (é dicir, a maioría dos CLS), carga diferida só por debaixo do pregamento.
  3. HTTPS en todas partes : un esquema canónico + host, variantes http e www que se incorporan a 301.

Capa 5: datos estruturados (comprobacións 15–16)

  1. Esquema en cada modelo que cumpra os requisitos (Produto+Oferta en produtos, Artigo en publicacións, Lista de rutas de navegación en todo o sitio, Organización única) e validación na proba de resultados enriquecidos ( guía de esquemas ).
  2. O esquema coincide coa páxina visible. Os prezos, a dispoñibilidade e as cualificacións en JSON-LD son idénticos ao que ven os humanos; a deriva obtén accións manuais.

Capa 6: a capa do rastreador de IA (comprobacións 17–20)

  1. Rastreadores de IA permitidos explicitamente en robots.txt (GPTBot, OAI-SearchBot, ClaudeBot, PerplexityBot, Google-Extended), supoñendo que queiras existir nas respostas de IA ( argumentou a decisión ).
  2. llms.txt publicado na raíz, listando as túas páxinas citables ( xerador + guía ).
  3. Respostas extraíbles de HTML bruto : as páxinas clave ábrense cunha resposta directa de dúas frases; os bloques de preguntas frecuentes levan o esquema FAQPage ( a disciplina AEO ).
  4. Verifica que os motores de IA poidan realmente buscarte : unha busca de Googlebot-UA que devolve unha páxina de desafío da CDN en lugar de contido significa que a protección do teu bot tamén está a consumir a túa visibilidade da IA.

Executándoo de verdade

Manual, o pase leva unha tarde coa pila gratuíta: GSC + o simulador + PSI + proba de resultados enriquecidos. A escala de catálogo, as comprobacións son a metade fácil e os centos de correccións por páxina son o muro, que é a metade que RankEngine automatiza para Shopify : executa estas comprobacións en cada produto, colección e páxina continuamente e logo aplica e verifica as correccións a través da API. De calquera xeito, a disciplina é a mesma: auditar nos cambios, monitorizar sempre e nunca pulir a capa 5 mentres a capa 1 se esvaece.