Краткий ответ: выполните эти 20 проверок в порядке слоев — сначала индексируемость (одна случайная ошибка индексации перевешивает все остальное), затем четкость сканирования, рендеринг, производительность, структурированные данные и слой ИИ-краулера. Для каждой проверки ниже есть условие успешного прохождения, которое вы можете проверить самостоятельно, в большинстве случаев с помощью бесплатных инструментов. Полный проход — ежеквартально; целевой проход — после каждой смены темы, перехода на новую платформу или массового редактирования.
Порядок — это метод: каждый слой определяет порядок нижестоящих. Идеальная схема на неиндексированной странице — это всего лишь украшение. Работайте сверху вниз и прекратите дорабатывать нижние слои, пока верхний не начнет давать сбой.
Уровень 1 — Индексируемость (проверки 1–4)
- Не допускайте случайного использования noindex. Просматривайте исходный код (или используйте команду `fetch as Googlebot` ) на ваших главных страницах: не используйте метатеги robots или X-Robots-Tag, содержащие noindex. Это техническая ошибка, способная положить конец вашей карьере; она постоянно исправляется с помощью обновлений темы и тестовой загрузки. ( Что означают эти директивы .)
- Ключевые страницы возвращают код 200. Не цепочки переадресаций 302, не шаблоны мягкой ошибки 404. Переадресация максимум на один шаг.
- Файл robots.txt не блокирует ничего, что должно ранжироваться. Заблокированная страница также не может отображать свой noindex — блокировка и деиндексация — это разные задачи ( руководство по robots.txt ; генератор ).
- В Search Console отображаются проиндексированные страницы. В отчете по страницам → ваши основные URL-адреса в разделе «Проиндексировано», и в этом отчете объясняется каждая причина исключения, а не игнорируется. ( Настройка GSC .)
Слой 2 — Четкость изображения при ползании (проверки 5–9)
- На каждой странице используется один самоссылающийся канонический URL ; варианты и параметры канонизируются по чистому URL ( механика защиты от дублирования контента ).
- Карта сайта заполнена и очищена — все индексируемые страницы введены, все страницы, на которые есть перенаправления/ошибки 404/неиндексированные страницы удалены, отправлены в Google Search Console ( руководство по созданию карты сайта ).
- Никаких лишних страниц — вся важная информация доступна по внутренним ссылкам, в идеале — в три клика с главной страницы.
- Регулярная переадресация — никаких цепочек переадресаций после одного перехода, никаких циклов, и каждый устаревший URL с входящими ссылками должен выводить 301-запрос в соответствующее место ( восстановление ).
- hreflang корректно работает при многоязычности — двунаправленные пары, x-default, самовключение ( руководство по hreflang ).
Слой 3 — Рендеринг (проверки 10–11)
- Контент существует в виде чистого HTML-кода. Загрузите любую ключевую страницу как Googlebot : заголовок, H1, основной текст и информация о продукте присутствуют без JavaScript. Если загрузка происходит в виде пустой оболочки, Google индексирует страницу медленно, а поисковые роботы с искусственным интеллектом — вообще не индексируют ( решения для SPA ).
- Один заголовок H1, логичная структура заголовков, настоящие HTML-ссылки (теги якоря, а не обработчики кликов JavaScript) для всего, по чему должны переходить поисковые роботы.
Уровень 4 — Производительность (проверки 12–14)
- Core Web Vitals передает полевые данные — LCP < 2,5 с, INP < 200 мс, CLS < 0,1, в разделе реальных пользователей PageSpeed Insights, с приоритетом мобильных устройств.
- Изображения масштабируются и сжимаются — используются современные форматы, заявлены размеры (что характерно для большинства CLS), отложенная загрузка происходит только ниже видимой части экрана.
- HTTPS повсюду — одна каноническая схема + хост, варианты http и www перенаправляются на неё с помощью кода 301.
Уровень 5 — Структурированные данные (проверки 15–16)
- Схема применяется ко всем подходящим шаблонам — Product+Offer для товаров, Article для записей, BreadcrumbList для всего сайта, Organization один раз — и проверяется в тесте расширенных результатов ( руководство по схемам ).
- Схема соответствует видимой странице. Цены, наличие товаров, рейтинги в формате JSON-LD идентичны тому, что видят люди; отклонения требуют ручного вмешательства.
Уровень 6 — Уровень краулера ИИ (проверки 17–20)
- В файле robots.txt явно разрешены поисковые роботы с искусственным интеллектом — GPTBot, OAI-SearchBot, ClaudeBot, PerplexityBot, Google-Extended — при условии, что вы хотите существовать в сфере ответов на вопросы, решаемые ИИ ( так было заявлено ).
- Файл llms.txt, размещенный в корневой директории, содержит список цитируемых страниц ( генератор + руководство ).
- Ответы можно извлечь из исходного HTML-кода — ключевые страницы открываются с прямым ответом в двух предложениях; блоки FAQ содержат схему FAQPage ( дисциплина AEO ).
- Убедитесь, что системы искусственного интеллекта действительно могут получить к вам доступ — если запрос Googlebot-UA возвращает страницу проверки CDN вместо контента, это означает, что ваша защита от ботов также снижает вашу видимость в системе ИИ.
Запускаю это в реальных условиях
В ручном режиме проверка занимает полдня с использованием бесплатного набора инструментов: GSC + симулятор + PSI + тест расширенных результатов. При работе с каталогами проверка — это легкая половина дела, а сотни исправлений на каждой странице — это настоящая преграда, которую RankEngine автоматизирует для Shopify : он непрерывно выполняет эти проверки для каждого товара, коллекции и страницы, а затем применяет и проверяет исправления через API. В любом случае, принцип тот же: аудит изменений, постоянный мониторинг и никогда не дорабатывайте пятый уровень, пока первый находится в процессе.
RankEngine