잘 쓴 콘텐츠가 AI 엔진의 답변에서 완전히 사라지는 경우, 원인의 90%는 글이 아니라 기술 계층에 있습니다. GPTBot이 빈 HTML만 가져가거나, 스키마 필드의 절반이 빠져 있거나, canonical URL이 엉뚱한 주소를 가리키는 식입니다. 이런 문제는 분석 보고서에도 잘 드러나지 않고 편집자가 읽을 때도 이상을 느끼기 어렵습니다. 하지만 ChatGPT, Perplexity, Google AI Overviews가 답변 후보를 추릴 때 해당 페이지를 제외하기에는 충분합니다.
콘텐츠 품질보다 기술 오류가 더 치명적인 이유
전통적인 SEO에서는 기술적 결함이 있어도 대개 검색 순위가 몇 계단 내려가는 데 그칩니다. AEO는 다릅니다. AI 엔진은 답변을 생성할 때 ‘깔끔하게 추출할 수 있고, 출처를 신뢰할 수 있으며, 구조가 명확한’ 소수의 페이지만 선택합니다. 8위로 밀리는 것이 아니라 처음부터 후보 목록에 들지 못하는 것입니다. B2B SaaS 고객을 대상으로 GEO 감사를 진행하다 보면 Google 검색 결과 첫 페이지에 노출되면서도 어떤 AI 엔진에도 인용되지 않는 콘텐츠를 자주 발견합니다. 문제 지점은 거의 예외 없이 다음 10곳에 있으며, 크게 ‘가져올 수 없음’, ‘이해할 수 없음’, ‘신뢰할 수 없음’의 세 계층으로 나뉩니다.
1단계: 콘텐츠를 가져오지 못하면 아무것도 시작되지 않습니다
가장 기초적인 오류는 크롤러가 콘텐츠를 가져오는 단계에서 발생합니다. AI 크롤러가 본문을 아예 수집하지 못한다면 아무리 정교한 스키마를 작성해도 소용없습니다. 다음 세 문제는 동시에 발생하는 경우가 많지만, 브라우저 화면에서는 모든 것이 정상처럼 보여 특히 놓치기 쉽습니다.
- 오류 1|robots.txt가 AI 크롤러를 잘못 차단함: 오래된 설정을 그대로 사용해 GPTBot, ClaudeBot, PerplexityBot 또는 Google-Extended를 일괄 차단하는 웹사이트가 많습니다. 해결법: 인용을 허용하려는 AI 크롤러를 robots.txt에서 명시적으로 허용합니다. 이후 서버 로그를 열어 실제로 200 응답을 받는지, 다른 설정에 의해 차단되지는 않는지 확인합니다.
- 오류 2|콘텐츠가 클라이언트 측 JavaScript로만 렌더링됨: 대부분의 AI 크롤러는 JS를 실행하지 않아 내용이 없는 div 껍데기만 수집합니다. 해결법: 핵심 콘텐츠에는 서버 측 렌더링이나 정적 생성을 적용합니다. 브라우저의 ‘페이지 소스 보기’에서 로딩을 기다리지 않아도 본문이 HTML에 직접 들어 있는지 확인합니다.
- 오류 3|응답이 지나치게 느리거나 시간 초과가 발생함: 크롤러에는 정해진 크롤링 예산이 있어 페이지 응답이 너무 늦으면 수집을 포기합니다. 해결법: 핵심 콘텐츠 페이지의 서버 응답 시간을 줄여 AI 크롤러가 로딩 애니메이션 앞에서 멈추지 않도록 합니다.
2단계: 가져왔지만 내용을 이해하지 못합니다
콘텐츠 수집에 성공했다면 다음 관문은 기계가 ‘이 페이지가 어떤 질문에 답하는가’를 해석할 수 있느냐입니다. 이 단계의 오류는 사람의 읽기 경험에는 거의 영향을 주지 않고 알고리즘만 막히게 하므로 눈에 잘 띄지 않습니다.
- 오류 4|구조화 데이터가 전혀 없음: Article, FAQPage, Organization 스키마가 빠져 있으면 AI는 페이지의 주제와 작성자를 추측해야 합니다. 해결법: 최소한 Article과 Organization을 추가하고, 문답형 페이지에는 FAQPage를 적용합니다. 이어서 Rich Results Test로 오류가 없는지 검증합니다.
- 오류 5|제목 계층이 뒤엉켜 있음: 한 페이지에 H1이 여러 개 있고 H2를 몰아넣거나 H4로 바로 건너뛰면 기계가 의미 구조를 해석하기 어려워집니다. 해결법: 페이지마다 H1은 하나만 사용하고 제목 수준을 순서대로 구성합니다. 각 H2는 독립적으로 답할 수 있는 질문 하나에 대응하도록 작성합니다.
- 오류 6|답이 긴 문단 한가운데 묻혀 있음: AI는 질문에 곧바로 답이 이어지고 문단 전체를 하나의 답변으로 추출할 수 있는 구성을 선호합니다. 해결법: 문단의 첫 문장에 핵심 결론을 제시하고, 주요 수치와 정의는 독립된 문장으로 작성합니다. 답을 세 번째 문단 중간중간에 흩어 놓지 마십시오.
- 오류 7|canonical과 중복 콘텐츠가 충돌함: 같은 글에 URL이 여러 개 존재하고 canonical 지정이 잘못되거나 서로 모순되면 평가 신호가 분산됩니다. 해결법: 페이지마다 명확한 표준 URL을 지정하고, 매개변수 페이지와 페이지네이션 URL도 모두 canonical 버전을 가리키게 합니다.

3단계: 읽을 수 있지만 충분히 신뢰할 수 없습니다
마지막 계층에서는 AI가 출처로 ‘이름을 걸고’ 인용할 의향이 있는지를 판단합니다. 콘텐츠를 추출할 수 있다는 사실만으로는 충분하지 않습니다. 엔진은 해당 구절이 답변에 포함할 만큼 신뢰할 수 있는지도 평가해야 합니다. 이 계층은 Brand Radar의 브랜드 노출에도 영향을 주기 때문에 브랜드 중심 고객에게 특히 중요합니다.
- 오류 8|E-E-A-T 신호가 부족함: 작성자가 명확하지 않고 게시일과 수정일이 없으며, 주장을 검증할 근거도 제시하지 않습니다. 해결법: 모든 글에 실제 작성자와 날짜를 표시하고 sameAs를 추가해 신뢰할 수 있는 프로필이나 자료와 연결합니다. 중요한 주장에는 링크로 확인할 수 있는 출처를 덧붙입니다.
- 오류 9|텍스트가 아닌 콘텐츠를 인용할 수 없음: 차트에는 alt 텍스트가 없고 동영상에는 전체 대본이 없습니다. 해결법: 중요한 차트에는 내용을 설명하는 alt를 추가하고 동영상에는 transcript를 첨부합니다. 그래야 텍스트만 처리하는 엔진도 콘텐츠를 추출할 수 있습니다.
- 오류 10|AI에 사이트 지도를 제공하지 않음: sitemap이나 llms.txt가 없으면 AI는 핵심 페이지의 위치를 추측해야 합니다. 해결법: XML sitemap을 관리하고, 가장 인용되기를 원하는 핵심 페이지를 llms.txt에 명확히 표시합니다.
10가지를 한꺼번에 해결하기 어렵다면 이 4가지부터 시작하십시오
리소스가 부족할수록 우선순위는 분명합니다. 먼저 가져올 수 있어야 하고, 다음으로 내용을 이해할 수 있어야 하며, 마지막으로 신뢰할 수 있어야 합니다. AI 크롤러가 완전한 HTML을 가져가는지부터 확인하고(오류 1, 2), 가장 기본적인 Article 및 FAQPage 스키마를 추가한 뒤(오류 4), 표준 URL을 정리합니다(오류 7). 이 4가지만 처리해도 한 번도 인용되지 않던 페이지가 다시 답변 후보로 검토될 가능성이 생깁니다. 이후 신뢰 계층의 세부 항목을 보완하면 됩니다.
AEO의 핵심은 콘텐츠를 더 잘 쓰는 데 있지 않습니다. 이미 충분히 좋은 콘텐츠를 기계가 깔끔하게 가져갈 수 있는 형태로 바꾸는 일입니다.— Tenten GEO Team
30일 안에 직접 검증할 수 있는 것
위 10가지 오류 중 절반은 브라우저와 무료 도구만으로 찾을 수 있습니다. 실제로 시간이 드는 일은 어느 문제가 AI 브랜드 노출을 가장 크게 떨어뜨리는지 판단하고, 수정 후 실제 인용으로 이어지는지 확인하는 것입니다. 불필요한 시행착오를 줄이고 싶다면 30분 GEO 진단을 예약할 수 있습니다. 핵심 페이지 3개를 현장에서 점검해 무엇부터 조치해야 하는지 바로 짚어드립니다. Tenten의 GEO 감사에서는 이 10개 항목을 30일 전체 점검 목록으로 확장합니다.



