Краткий ответ: выполните эти 20 проверок в порядке слоев — сначала индексируемость (одна случайная ошибка индексации перевешивает все остальное), затем четкость сканирования, рендеринг, производительность, структурированные данные и слой ИИ-краулера. Для каждой проверки ниже есть условие успешного прохождения, которое вы можете проверить самостоятельно, в большинстве случаев с помощью бесплатных инструментов. Полный проход — ежеквартально; целевой проход — после каждой смены темы, перехода на новую платформу или массового редактирования.

Порядок — это метод: каждый слой определяет порядок нижестоящих. Идеальная схема на неиндексированной странице — это всего лишь украшение. Работайте сверху вниз и прекратите дорабатывать нижние слои, пока верхний не начнет давать сбой.

Уровень 1 — Индексируемость (проверки 1–4)

  1. Не допускайте случайного использования noindex. Просматривайте исходный код (или используйте команду `fetch as Googlebot` ) на ваших главных страницах: не используйте метатеги robots или X-Robots-Tag, содержащие noindex. Это техническая ошибка, способная положить конец вашей карьере; она постоянно исправляется с помощью обновлений темы и тестовой загрузки. ( Что означают эти директивы .)
  2. Ключевые страницы возвращают код 200. Не цепочки переадресаций 302, не шаблоны мягкой ошибки 404. Переадресация максимум на один шаг.
  3. Файл robots.txt не блокирует ничего, что должно ранжироваться. Заблокированная страница также не может отображать свой noindex — блокировка и деиндексация — это разные задачи ( руководство по robots.txt ; генератор ).
  4. В Search Console отображаются проиндексированные страницы. В отчете по страницам → ваши основные URL-адреса в разделе «Проиндексировано», и в этом отчете объясняется каждая причина исключения, а не игнорируется. ( Настройка GSC .)

Слой 2 — Четкость изображения при ползании (проверки 5–9)

  1. На каждой странице используется один самоссылающийся канонический URL ; варианты и параметры канонизируются по чистому URL ( механика защиты от дублирования контента ).
  2. Карта сайта заполнена и очищена — все индексируемые страницы введены, все страницы, на которые есть перенаправления/ошибки 404/неиндексированные страницы удалены, отправлены в Google Search Console ( руководство по созданию карты сайта ).
  3. Никаких лишних страниц — вся важная информация доступна по внутренним ссылкам, в идеале — в три клика с главной страницы.
  4. Регулярная переадресация — никаких цепочек переадресаций после одного перехода, никаких циклов, и каждый устаревший URL с входящими ссылками должен выводить 301-запрос в соответствующее место ( восстановление ).
  5. hreflang корректно работает при многоязычности — двунаправленные пары, x-default, самовключение ( руководство по hreflang ).

Слой 3 — Рендеринг (проверки 10–11)

  1. Контент существует в виде чистого HTML-кода. Загрузите любую ключевую страницу как Googlebot : заголовок, H1, основной текст и информация о продукте присутствуют без JavaScript. Если загрузка происходит в виде пустой оболочки, Google индексирует страницу медленно, а поисковые роботы с искусственным интеллектом — вообще не индексируют ( решения для SPA ).
  2. Один заголовок H1, логичная структура заголовков, настоящие HTML-ссылки (теги якоря, а не обработчики кликов JavaScript) для всего, по чему должны переходить поисковые роботы.

Уровень 4 — Производительность (проверки 12–14)

  1. Core Web Vitals передает полевые данные — LCP < 2,5 с, INP < 200 мс, CLS < 0,1, в разделе реальных пользователей PageSpeed Insights, с приоритетом мобильных устройств.
  2. Изображения масштабируются и сжимаются — используются современные форматы, заявлены размеры (что характерно для большинства CLS), отложенная загрузка происходит только ниже видимой части экрана.
  3. HTTPS повсюду — одна каноническая схема + хост, варианты http и www перенаправляются на неё с помощью кода 301.

Уровень 5 — Структурированные данные (проверки 15–16)

  1. Схема применяется ко всем подходящим шаблонам — Product+Offer для товаров, Article для записей, BreadcrumbList для всего сайта, Organization один раз — и проверяется в тесте расширенных результатов ( руководство по схемам ).
  2. Схема соответствует видимой странице. Цены, наличие товаров, рейтинги в формате JSON-LD идентичны тому, что видят люди; отклонения требуют ручного вмешательства.

Уровень 6 — Уровень краулера ИИ (проверки 17–20)

  1. В файле robots.txt явно разрешены поисковые роботы с искусственным интеллектом — GPTBot, OAI-SearchBot, ClaudeBot, PerplexityBot, Google-Extended — при условии, что вы хотите существовать в сфере ответов на вопросы, решаемые ИИ ( так было заявлено ).
  2. Файл llms.txt, размещенный в корневой директории, содержит список цитируемых страниц ( генератор + руководство ).
  3. Ответы можно извлечь из исходного HTML-кода — ключевые страницы открываются с прямым ответом в двух предложениях; блоки FAQ содержат схему FAQPage ( дисциплина AEO ).
  4. Убедитесь, что системы искусственного интеллекта действительно могут получить к вам доступесли запрос Googlebot-UA возвращает страницу проверки CDN вместо контента, это означает, что ваша защита от ботов также снижает вашу видимость в системе ИИ.

Запускаю это в реальных условиях

В ручном режиме проверка занимает полдня с использованием бесплатного набора инструментов: GSC + симулятор + PSI + тест расширенных результатов. При работе с каталогами проверка — это легкая половина дела, а сотни исправлений на каждой странице — это настоящая преграда, которую RankEngine автоматизирует для Shopify : он непрерывно выполняет эти проверки для каждого товара, коллекции и страницы, а затем применяет и проверяет исправления через API. В любом случае, принцип тот же: аудит изменений, постоянный мониторинг и никогда не дорабатывайте пятый уровень, пока первый находится в процессе.