Resposta rápida: executa estas 20 comprobacións por orde de capas: primeiro a indexación (unha falta de índice accidental supera todo o demais), despois a claridade da rastrexación, a renderización, o rendemento, os datos estruturados e a capa da rastrexadora de IA. Cada comprobación que aparece a continuación ten unha condición de aprobación que podes verificar ti mesmo, a maioría con ferramentas gratuítas. Aprobación completa trimestral; aprobación específica despois de cada cambio de tema, replataforma ou edición masiva.
A ordenación é o método: cada capa limita as capas inferiores. Un esquema perfecto nunha páxina sen indexación é a decoración. Traballa de arriba a abaixo e deixa de pulir as capas inferiores mentres falla unha superior.
Capa 1: Indexabilidade (comprobacións 1–4)
- Sen noindex accidental. Ver código fonte (ou buscar como Googlebot ) nas túas páxinas de diñeiro: non hai metadatos de robots nin etiquetas X-Robots que conteñan noindex. O erro técnico que pon fin á carreira; envíase constantemente a través de actualizacións de temas e pushs de proba. ( Que significan as directivas ).
- As páxinas clave devolven 200. Non cadeas 302, nin modelos soft-404. Redirecciona como máximo un salto.
- robots.txt non bloquea nada que debería posicionarse. Unha páxina bloqueada tampouco pode mostrar o seu noindex: bloquear e desindexar son tarefas diferentes ( guía de robots ; xerador ).
- Search Console mostra as páxinas indexadas. Informe de páxinas → as URL do teu diñeiro en "Indexadas" e cada motivo de exclusión nese informe explicado, non ignorado. ( Configuración de GSC .)
Capa 2: claridade da exploración (comprobacións 5–9)
- Unha canónica autorreferenciada por páxina ; as variantes e os parámetros canonizanse no URL limpo ( mecánica de contido duplicado ).
- Mapa do sitio completo e limpo : todas as páxinas indexables de entrada, todas as páxinas redireccionadas/404/noindexed de saída, enviadas en GSC ( guía do mapa do sitio ).
- Sen páxinas orfas : todo o importante está accesible mediante ligazóns internas, idealmente a tres clics da páxina de inicio.
- Hixiene de redirección : sen cadeas despois dun salto, sen bucles e cada URL retirada con ligazóns entrantes 301 nalgún lugar relevante ( recuperación ).
- hreflang correcto se é multilingüe : pares bidireccionais, predeterminado por x, autoinclusión ( guía de hreflang ).
Capa 3: Renderización (comprobacións 10–11)
- O contido existe en HTML bruto. Obtén calquera páxina clave como Googlebot : título, H1, corpo de texto e información do produto presentes sen JavaScript. Se a busca bruta é un shell, Google indexa a páxina lentamente e os rastreadores de IA non o farán en absoluto ( correccións SPA ).
- Un H1, unha árbore de títulos sensata, ligazóns HTML reais (etiquetas de ancoraxe, non xestores de clics JS) para calquera cousa que os rastreadores deban seguir.
Capa 4: rendemento (comprobacións 12–14)
- Os datos vitais web principais transmiten datos de campo : LCP < 2,5 s, INP < 200 ms, CLS < 0,1, na sección de usuario real de PageSpeed Insights, primeiro para móbiles.
- Imaxes dimensionadas e comprimidas : formatos modernos, dimensións declaradas (é dicir, a maioría dos CLS), carga diferida só por debaixo do pregamento.
- HTTPS en todas partes : un esquema canónico + host, variantes http e www que se incorporan a 301.
Capa 5: datos estruturados (comprobacións 15–16)
- Esquema en cada modelo que cumpra os requisitos (Produto+Oferta en produtos, Artigo en publicacións, Lista de rutas de navegación en todo o sitio, Organización única) e validación na proba de resultados enriquecidos ( guía de esquemas ).
- O esquema coincide coa páxina visible. Os prezos, a dispoñibilidade e as cualificacións en JSON-LD son idénticos ao que ven os humanos; a deriva obtén accións manuais.
Capa 6: a capa do rastreador de IA (comprobacións 17–20)
- Rastreadores de IA permitidos explicitamente en robots.txt (GPTBot, OAI-SearchBot, ClaudeBot, PerplexityBot, Google-Extended), supoñendo que queiras existir nas respostas de IA ( argumentou a decisión ).
- llms.txt publicado na raíz, listando as túas páxinas citables ( xerador + guía ).
- Respostas extraíbles de HTML bruto : as páxinas clave ábrense cunha resposta directa de dúas frases; os bloques de preguntas frecuentes levan o esquema FAQPage ( a disciplina AEO ).
- Verifica que os motores de IA poidan realmente buscarte : unha busca de Googlebot-UA que devolve unha páxina de desafío da CDN en lugar de contido significa que a protección do teu bot tamén está a consumir a túa visibilidade da IA.
Executándoo de verdade
Manual, o pase leva unha tarde coa pila gratuíta: GSC + o simulador + PSI + proba de resultados enriquecidos. A escala de catálogo, as comprobacións son a metade fácil e os centos de correccións por páxina son o muro, que é a metade que RankEngine automatiza para Shopify : executa estas comprobacións en cada produto, colección e páxina continuamente e logo aplica e verifica as correccións a través da API. De calquera xeito, a disciplina é a mesma: auditar nos cambios, monitorizar sempre e nunca pulir a capa 5 mentres a capa 1 se esvaece.
RankEngine