Google 검증 도구를 통과했다고 해서 AI 엔진도 구조화 데이터를 가져갈 수 있는 것은 아닙니다. 두 시스템의 파싱 경로가 다르기 때문입니다. Rich Results Test는 Google이 지원하는 일부 리치 결과의 자격 요건만 확인하고, Schema.org Validator는 문법이 어휘 명세에 맞는지만 검사합니다. 어느 도구도 ChatGPT, Perplexity 또는 Google AI Overviews의 크롤러가 페이지에서 실제로 무엇을 읽는지는 알려주지 않습니다. 검증 결과가 모두 정상인데도 AI 답변에는 전혀 노출되지 않는 페이지가 적지 않습니다. 바로 이 간극이 문제입니다.
‘검증 통과’가 ‘AI가 읽을 수 있음’을 뜻하지 않는 이유
검증 도구의 역할은 ‘규격 준수 여부 확인’이지 ‘크롤러가 읽을 수 있는지 확인’하는 것이 아닙니다. Schema.org Validator는 JSON-LD를 schema.org 어휘와 대조해 타입과 속성의 철자가 맞는지, 중첩 구조가 유효한지 검사합니다. Rich Results Test는 Googlebot이 페이지를 렌더링하는 방식을 시뮬레이션해 특정 리치 결과를 표시할 자격이 있는지 판단합니다. 두 검사를 마쳐도 알 수 있는 것은 ‘문법이 맞는가’와 ‘Google이 리치 결과를 제공할 가능성이 있는가’뿐입니다. 반면 많은 AI 크롤러는 서버가 반환한 원본 HTML을 직접 수집하고 JavaScript를 실행하지 않으며, 리치 결과 자격 여부에도 관심이 없습니다. AI가 구조화 데이터를 읽을 수 있는지는 결국 JSON-LD가 원본 HTML에 포함돼 있는지, 엔티티가 서로 연결돼 있는지에 달려 있습니다.
꼭 필요한 두 가지 도구와 각각의 사각지대
각 도구가 무엇을 놓치는지 이해하려면 먼저 두 도구의 역할부터 명확히 구분해야 합니다.
- Rich Results Test(search.google.com/test/rich-results): Googlebot으로 페이지를 직접 렌더링하고 JS를 실행한 뒤, 감지된 리치 결과 유형과 오류·경고를 항목별로 보여줍니다. 다만 Google이 지원하는 약 30개 유형만 검사한다는 한계가 있습니다. 리치 결과를 생성하지 않는 Organization이나 Person 같은 타입을 마크업하면 ‘항목이 감지되지 않음’으로 표시될 수 있지만, 그렇다고 스키마가 유효하지 않다는 뜻은 아닙니다.
- Schema.org Validator(validator.schema.org): Google의 지원 여부와 관계없이 모든 타입의 전체 엔티티 트리를 보여주므로 문법과 어휘를 점검하기에 적합합니다. 다만 기본적으로 JS를 실행해 주지 않습니다. 소스 코드를 붙여 넣거나 URL을 입력하면 렌더링 전 버전을 가져오는 경우가 많습니다. 리치 결과 자격 여부를 알려주지 않고, 일부 의미론적 오류를 지나치게 관대하게 처리하는 것도 한계입니다.
결론은 간단합니다. 두 도구를 함께 사용하되, 각 단계에서 무엇을 확인하는지 분명히 해야 합니다. Schema.org Validator로 구문과 엔티티 구조를 검사하고, Rich Results Test로 Google 리치 결과 자격과 렌더링 결과를 확인합니다. 그러나 ‘JS를 실행하지 않는 크롤러도 볼 수 있는가’라는 질문에는 어느 도구도 답하지 못합니다. 이를 확인하려면 다음 단계에서 소스 코드를 직접 점검해야 합니다.
반복 실행할 수 있는 스키마 검증 워크플로
검증 절차를 정해진 순서로 표준화하고, 모든 페이지와 수정 사항에 같은 체크리스트를 적용해야 합니다. 그래야 감에 의존해 검사하다가 매번 다른 허점을 놓치는 일을 막을 수 있습니다.
- Schema.org Validator에 ‘렌더링된’ HTML을 붙여 넣습니다. 문법과 어휘가 올바른지 확인하고 전체 엔티티 트리를 펼쳐 타입과 필수 속성을 하나씩 점검합니다.
- Rich Results Test에 운영 URL을 입력합니다. Google이 렌더링된 버전을 가져오는지, 목표로 한 리치 결과 유형을 인식하는지, 빨간색 오류가 없는지 확인합니다.
- curl 또는 view-source로 JS를 실행하지 않은 원본 HTML을 가져옵니다. application/ld+json을 검색해 JSON-LD가 서버 응답에 실제로 포함돼 있는지 확인합니다. 이 단계는 대부분의 AI 크롤러가 페이지를 수집하는 방식을 재현합니다.
- Organization, WebSite, Article, Person의 @id와 @type 참조 관계를 점검합니다. 일관된 @id로 엔티티가 하나의 구조로 연결돼 있는지 확인해야 엔진이 작성자의 소속 조직과 아티클이 속한 웹사이트를 파악할 수 있습니다.
- 스키마 값과 페이지에 표시되는 콘텐츠를 항목별로 대조합니다. 가격, 제목, 평점, 날짜가 모두 일치해야 합니다. 값이 다르면 Google이 해당 정보를 무시할 수 있고 AI의 신뢰도도 낮아집니다.
- 기준 스냅샷을 저장합니다. 수정할 때마다 전체 체크리스트를 다시 실행하고, 이전 결과와의 차이를 회귀 오류로 점검합니다.

AI 엔진이 실제로 읽지 못하는 오류 유형
문법 검사를 통과한 스키마에도 ‘도구는 정상이라고 하지만 AI는 읽지 못하는’ 오류가 남아 있을 수 있습니다. 고객사 감사에서 가장 자주 발견하는 사례는 다음과 같습니다.
- 프런트엔드 프레임워크나 태그 관리자가 브라우저에서 JSON-LD를 삽입합니다. 서버가 반환한 원본 HTML에는 관련 코드가 한 줄도 없어 JS를 실행하지 않는 크롤러는 이를 전혀 볼 수 없습니다.
- @id가 없거나 일관되지 않아 엔티티를 연결할 수 없습니다. 이 경우 엔진은 작성자, 조직, 아티클을 하나의 지식 그래프 노드로 묶지 못합니다.
- 타입은 올바르게 선택했지만 값을 잘못된 필드에 넣었습니다. 통화를 price에 입력하거나 설명 전체를 name에 넣고, offers에서 priceCurrency를 누락하는 경우입니다.
- 구문은 유효하지만 의미상 정보가 불완전합니다. Product에 offers가 없거나, Article에 author 또는 publisher가 빠져 있거나, FAQPage의 answer가 빈 문자열인 경우입니다.
- 한 페이지에 서로 충돌하는 JSON-LD가 여러 개 있습니다. 예를 들어 홈페이지 템플릿에 포함된 Organization과 개별 페이지에 포함된 Organization이 상충하면 엔진은 어떤 정보를 기준으로 삼아야 할지 판단하기 어렵습니다.
- 날짜가 ISO 8601 형식이 아니거나 이미지에 절대 URL 대신 상대 경로를 사용합니다. 관대한 검증 도구는 이런 값을 통과시킬 수 있지만, 데이터 추출 과정에서는 쉽게 제외됩니다.
도구 결과만 보지 말고 ‘렌더링된 DOM’과 ‘소스 코드’의 간극을 확인하세요
검증의 핵심은 페이지의 두 가지 버전을 동시에 확인하는 데 있습니다. DevTools의 Elements 패널을 열면 브라우저가 렌더링한 DOM을 볼 수 있습니다. 이는 Googlebot이 보는 모습과 대체로 비슷합니다. 반면 view-source나 curl로 확인하는 원본 HTML은 서버가 최초로 반환한 내용이며, 대부분의 AI 크롤러가 보게 되는 버전입니다. 구조화 데이터가 전자에만 있고 후자에는 없다면 그 간극 때문에 AI가 정보를 읽지 못합니다. 검증 도구는 첫 번째 버전을 확인하는 데 도움을 주지만, 두 번째 버전은 직접 점검해야 합니다.
스키마 검증은 출시 시 한 번 수행하고 끝내는 작업이 아닙니다. 수정할 때마다 반드시 다시 거쳐야 하는 단계입니다. CMS 업그레이드나 템플릿 조정만으로도 전체 엔티티 트리가 소리 없이 무너질 수 있습니다.— Tenten GEO Technical Audit Notes
검증을 출시 전 필수 단계로 만드세요
가장 실용적인 방법은 기억에 의존해 그때그때 확인하는 대신, 이 체크리스트를 출시 프로세스에 포함하는 것입니다. CI에 스크립트를 추가해 운영 URL의 원본 HTML을 가져오고, JSON-LD를 파싱한 뒤 필수 속성과 @id 참조를 비교할 수 있습니다. 누락된 항목이 있으면 배포를 차단하도록 설정합니다. CI를 사용하지 않는 팀이라도 최소한 6단계를 출시 전 체크리스트에 넣고, 수정 후 각 항목을 확인해야 합니다. 구조화 데이터의 가치는 기계가 안정적으로 추출할 수 있을 때 생기며, 그 안정성은 수동 검증의 운이 아니라 프로세스에서 나옵니다. JS를 실행하지 않는 크롤러가 페이지를 어떻게 보는지, 어떤 스키마를 AI가 전혀 읽지 못하는지 확인하려면 /contact에서 30분 GEO 진단을 예약하세요. 실제 페이지를 대상으로 이 워크플로를 실행해 드립니다.



