간단히 말씀드리면, 다음 20가지 검사를 순서대로 실행하세요. 인덱싱 가능성을 먼저 확인하고(실수로라도 noindex가 선언되면 다른 모든 문제가 상쇄됩니다), 그 다음으로 크롤링 명확성, 렌더링, 성능, 구조화된 데이터, 그리고 AI 크롤러 순으로 확인하세요. 아래 각 검사에는 통과 조건이 있으며, 대부분 무료 도구를 사용하여 직접 검증할 수 있습니다. 분기별로 전체 검사를 실시하고, 테마 변경, 플랫폼 변경 또는 일괄 편집 후에는 특정 항목에 대한 검사를 진행하세요.
순서가 핵심입니다. 각 계층은 그 아래 계층에 영향을 미칩니다. 색인되지 않은 페이지에서 완벽한 스키마는 장식일 뿐입니다. 위에서 아래로 작업하고, 상위 계층에 문제가 있는 동안에는 하위 계층을 다듬는 것을 멈추세요.
레이어 1 — 인덱싱 가능성(검사 1~4)
- 의도치 않은 noindex 추가는 금전적 손실을 초래할 수 있습니다. 수익 창출 페이지의 소스 코드(또는 Googlebot으로 가져오기 )를 확인해 보세요. robots.txt 파일이나 X-Robots 태그에 noindex가 포함되어 있지 않아야 합니다. 이는 개발자 경력을 끝낼 수도 있는 치명적인 기술적 버그이며, 테마 업데이트와 스테이징 배포를 통해 끊임없이 발생합니다. ( 지시문의 의미는 다음과 같습니다 .)
- 주요 페이지는 200 응답 코드를 반환합니다. 302 리디렉션 체인이나 소프트 404 템플릿을 사용하지 않습니다. 리디렉션은 최대 한 단계만 거칩니다.
- robots.txt는 순위에 올라야 할 페이지를 차단하지 않습니다. 차단된 페이지는 noindex를 표시할 수도 없습니다. 차단과 색인 해제는 별개의 작업입니다( robots 가이드 ; 생성기 ).
- 검색 콘솔에는 색인된 페이지가 표시됩니다. 페이지 보고서에서 "색인됨" 항목에 주요 URL이 표시되며, 해당 보고서에 있는 모든 제외 사유가 설명되어 있고 무시된 사유는 없습니다. ( Google Search Console 설정 )
2단계 — 크롤링 명확성 (5~9번 항목 확인)
- 페이지당 하나의 자체 참조 정규 URL이 존재 하며, 변형 및 매개변수는 깔끔한 URL로 정규화됩니다( 중복 콘텐츠 처리 방식 ).
- 사이트맵이 완벽하고 깔끔하게 정리되었습니다 . 색인 가능한 모든 페이지는 포함하고, 리디렉션/404/색인되지 않은 페이지는 모두 제외했으며, GSC에 제출했습니다( 사이트맵 가이드 참조 ).
- 고립된 페이지는 없어야 합니다 . 모든 중요한 페이지는 내부 링크를 통해 접근 가능해야 하며, 이상적으로는 홈페이지에서 세 번 클릭 이내에 도달할 수 있어야 합니다.
- 리디렉션 위생 — 1단계 이상 연쇄 리디렉션이 없어야 하고, 루프가 없어야 하며, 인바운드 링크가 있는 모든 사용 중지된 URL은 관련성이 있는 어딘가로 301 리디렉션되어야 합니다( 복구 ).
- hreflang은 다국어 환경에서 올바른 방향 쌍, x-기본값, 자체 포함을 지원합니다( hreflang 가이드 참조 ).
레이어 3 — 렌더링 (체크 10~11)
- 콘텐츠는 원시 HTML 형식으로 존재합니다. 제목, H1 태그, 본문 텍스트, 제품 정보 등 주요 페이지를 JavaScript 없이 Googlebot이 볼 수 있는 형식으로 가져오세요. 원시 HTML 형식으로 가져온 콘텐츠가 껍데기 형태라면 Google은 색인 생성을 느리게 하고 AI 크롤러는 아예 색인을 생성하지 않습니다( SPA 수정 필요 ).
- 크롤러가 따라가야 할 모든 항목에는 H1 태그 하나, 정상적인 제목 구조, 실제 HTML 링크 (JavaScript 클릭 핸들러가 아닌 앵커 태그)를 사용해야 합니다.
4단계 — 성능 (점검 항목 12~14)
- Core Web Vitals는 PageSpeed Insights의 실제 사용자 섹션(모바일 우선)에서 필드 데이터를 전달합니다 . LCP < 2.5초, INP < 200ms, CLS < 0.1입니다.
- 이미지 크기 조정 및 압축 - 최신 형식, 크기 명시(대부분의 CLS 방식), 화면 하단 영역만 지연 로딩.
- 모든 곳에서 HTTPS를 사용합니다. 하나의 표준 스키마와 호스트를 사용하며, http 및 www 변형은 모두 이 표준 스키마로 301 리디렉션됩니다.
5단계 — 구조화된 데이터 (확인 사항 15~16)
- 제품 템플릿의 Product+Offer, 게시물 템플릿의 Article, 사이트 전체의 BreadcrumbList, 그리고 조직 템플릿(한 번만 적용) 등 모든 적합한 템플릿에 스키마를 적용하고, 리치 결과 테스트에서 유효성을 검사합니다 ( 스키마 가이드 참조 ).
- 스키마는 표시되는 페이지와 일치합니다. 가격, 재고, 평점은 JSON-LD 형식으로 사람이 보는 것과 동일하며, 변경 사항이 발생하면 수동으로 조치합니다.
6단계 — AI 크롤러 단계(17~20번 항목 확인)
- robots.txt에서 AI 크롤러(GPTBot, OAI-SearchBot, ClaudeBot, PerplexityBot, Google-Extended)를 명시적으로 허용합니다 . 단, AI 답변에 포함되기를 원하는 경우에 한합니다( 결정 내용 ).
- 루트 디렉터리에 llms.txt 파일이 생성되어 인용 가능한 페이지 목록이 표시됩니다( 생성기 + 가이드 ).
- 답변은 원시 HTML에서 추출 가능하며 , 주요 페이지는 두 문장으로 된 직접적인 답변으로 시작됩니다. FAQ 블록은 FAQPage 스키마( AEO 규정 )를 따릅니다.
- AI 엔진이 실제로 콘텐츠를 가져올 수 있는지 확인하세요 . Googlebot-UA가 콘텐츠 대신 CDN 챌린지 페이지를 반환하는 경우, 봇 보호 기능 때문에 AI 가시성이 저하되고 있는 것입니다.
실제로 실행해 보세요
수동으로 검증하려면 무료 도구 모음(GSC + 시뮬레이터 + PSI + 풍부한 결과 테스트)을 사용하면 오후 시간 정도면 충분합니다. 하지만 카탈로그 규모에서는 검사 자체는 쉬운 부분이고, 페이지별로 수백 건에 달하는 수정 작업이 관건입니다. 바로 이 부분이 RankEngine이 Shopify를 위해 자동화해 주는 부분입니다. RankEngine은 모든 제품, 컬렉션, 페이지에 걸쳐 이러한 검사를 지속적으로 실행하고, API를 통해 수정 사항을 적용하고 검증합니다 . 어떤 방식을 사용하든 핵심 원칙은 동일합니다. 변경 사항을 감사하고, 항상 모니터링하며, 1단계 작업이 제대로 진행되지 않는 동안 5단계 작업을 미루지 않는 것입니다.
랭크엔진