Tenten AIGEO
블로그로 돌아가기
기술 AEO 구현도입·실행

가장 흔한 AEO 기술 오류 10가지와 해결법: 누락된 스키마부터 크롤러 차단 실수까지

AEO에서는 콘텐츠 품질보다 기술 오류가 더 치명적일 수 있습니다. 구조화 데이터 누락, GPTBot 같은 AI 크롤러의 잘못된 차단, canonical 혼선, 클라이언트 측 렌더링으로 인한 빈 HTML까지 가장 흔한 기술적 문제 10가지와 구체적인 해결법을 살펴봅니다. 우선순위와 3분 자가 점검 목록도 함께 제공합니다.

Tenten GEO 팀게시일 2026-04-275 분 소요
여러 갈래의 길이 막힌 AI 크롤러 로봇 앞에서 단 하나의 빛나는 통로만 콘텐츠로 이어지는 모습

잘 쓴 콘텐츠가 AI 엔진의 답변에서 완전히 사라지는 경우, 원인의 90%는 글이 아니라 기술 계층에 있습니다. GPTBot이 빈 HTML만 가져가거나, 스키마 필드의 절반이 빠져 있거나, canonical URL이 엉뚱한 주소를 가리키는 식입니다. 이런 문제는 분석 보고서에도 잘 드러나지 않고 편집자가 읽을 때도 이상을 느끼기 어렵습니다. 하지만 ChatGPT, Perplexity, Google AI Overviews가 답변 후보를 추릴 때 해당 페이지를 제외하기에는 충분합니다.

콘텐츠 품질보다 기술 오류가 더 치명적인 이유

전통적인 SEO에서는 기술적 결함이 있어도 대개 검색 순위가 몇 계단 내려가는 데 그칩니다. AEO는 다릅니다. AI 엔진은 답변을 생성할 때 ‘깔끔하게 추출할 수 있고, 출처를 신뢰할 수 있으며, 구조가 명확한’ 소수의 페이지만 선택합니다. 8위로 밀리는 것이 아니라 처음부터 후보 목록에 들지 못하는 것입니다. B2B SaaS 고객을 대상으로 GEO 감사를 진행하다 보면 Google 검색 결과 첫 페이지에 노출되면서도 어떤 AI 엔진에도 인용되지 않는 콘텐츠를 자주 발견합니다. 문제 지점은 거의 예외 없이 다음 10곳에 있으며, 크게 ‘가져올 수 없음’, ‘이해할 수 없음’, ‘신뢰할 수 없음’의 세 계층으로 나뉩니다.

1단계: 콘텐츠를 가져오지 못하면 아무것도 시작되지 않습니다

가장 기초적인 오류는 크롤러가 콘텐츠를 가져오는 단계에서 발생합니다. AI 크롤러가 본문을 아예 수집하지 못한다면 아무리 정교한 스키마를 작성해도 소용없습니다. 다음 세 문제는 동시에 발생하는 경우가 많지만, 브라우저 화면에서는 모든 것이 정상처럼 보여 특히 놓치기 쉽습니다.

  • 오류 1|robots.txt가 AI 크롤러를 잘못 차단함: 오래된 설정을 그대로 사용해 GPTBot, ClaudeBot, PerplexityBot 또는 Google-Extended를 일괄 차단하는 웹사이트가 많습니다. 해결법: 인용을 허용하려는 AI 크롤러를 robots.txt에서 명시적으로 허용합니다. 이후 서버 로그를 열어 실제로 200 응답을 받는지, 다른 설정에 의해 차단되지는 않는지 확인합니다.
  • 오류 2|콘텐츠가 클라이언트 측 JavaScript로만 렌더링됨: 대부분의 AI 크롤러는 JS를 실행하지 않아 내용이 없는 div 껍데기만 수집합니다. 해결법: 핵심 콘텐츠에는 서버 측 렌더링이나 정적 생성을 적용합니다. 브라우저의 ‘페이지 소스 보기’에서 로딩을 기다리지 않아도 본문이 HTML에 직접 들어 있는지 확인합니다.
  • 오류 3|응답이 지나치게 느리거나 시간 초과가 발생함: 크롤러에는 정해진 크롤링 예산이 있어 페이지 응답이 너무 늦으면 수집을 포기합니다. 해결법: 핵심 콘텐츠 페이지의 서버 응답 시간을 줄여 AI 크롤러가 로딩 애니메이션 앞에서 멈추지 않도록 합니다.

2단계: 가져왔지만 내용을 이해하지 못합니다

콘텐츠 수집에 성공했다면 다음 관문은 기계가 ‘이 페이지가 어떤 질문에 답하는가’를 해석할 수 있느냐입니다. 이 단계의 오류는 사람의 읽기 경험에는 거의 영향을 주지 않고 알고리즘만 막히게 하므로 눈에 잘 띄지 않습니다.

  • 오류 4|구조화 데이터가 전혀 없음: Article, FAQPage, Organization 스키마가 빠져 있으면 AI는 페이지의 주제와 작성자를 추측해야 합니다. 해결법: 최소한 Article과 Organization을 추가하고, 문답형 페이지에는 FAQPage를 적용합니다. 이어서 Rich Results Test로 오류가 없는지 검증합니다.
  • 오류 5|제목 계층이 뒤엉켜 있음: 한 페이지에 H1이 여러 개 있고 H2를 몰아넣거나 H4로 바로 건너뛰면 기계가 의미 구조를 해석하기 어려워집니다. 해결법: 페이지마다 H1은 하나만 사용하고 제목 수준을 순서대로 구성합니다. 각 H2는 독립적으로 답할 수 있는 질문 하나에 대응하도록 작성합니다.
  • 오류 6|답이 긴 문단 한가운데 묻혀 있음: AI는 질문에 곧바로 답이 이어지고 문단 전체를 하나의 답변으로 추출할 수 있는 구성을 선호합니다. 해결법: 문단의 첫 문장에 핵심 결론을 제시하고, 주요 수치와 정의는 독립된 문장으로 작성합니다. 답을 세 번째 문단 중간중간에 흩어 놓지 마십시오.
  • 오류 7|canonical과 중복 콘텐츠가 충돌함: 같은 글에 URL이 여러 개 존재하고 canonical 지정이 잘못되거나 서로 모순되면 평가 신호가 분산됩니다. 해결법: 페이지마다 명확한 표준 URL을 지정하고, 매개변수 페이지와 페이지네이션 URL도 모두 canonical 버전을 가리키게 합니다.
AEO 기술 개선의 3단계 퍼널인 크롤링 계층, 구조 계층, 신뢰 계층을 차례로 통과해야 AI에 인용될 수 있음을 보여주는 그림
AI 인용 여부는 하나의 설정으로 결정되지 않습니다. 크롤링, 구조, 신뢰라는 세 가지 기술 계층을 차례로 통과해야 합니다.

3단계: 읽을 수 있지만 충분히 신뢰할 수 없습니다

마지막 계층에서는 AI가 출처로 ‘이름을 걸고’ 인용할 의향이 있는지를 판단합니다. 콘텐츠를 추출할 수 있다는 사실만으로는 충분하지 않습니다. 엔진은 해당 구절이 답변에 포함할 만큼 신뢰할 수 있는지도 평가해야 합니다. 이 계층은 Brand Radar의 브랜드 노출에도 영향을 주기 때문에 브랜드 중심 고객에게 특히 중요합니다.

  • 오류 8|E-E-A-T 신호가 부족함: 작성자가 명확하지 않고 게시일과 수정일이 없으며, 주장을 검증할 근거도 제시하지 않습니다. 해결법: 모든 글에 실제 작성자와 날짜를 표시하고 sameAs를 추가해 신뢰할 수 있는 프로필이나 자료와 연결합니다. 중요한 주장에는 링크로 확인할 수 있는 출처를 덧붙입니다.
  • 오류 9|텍스트가 아닌 콘텐츠를 인용할 수 없음: 차트에는 alt 텍스트가 없고 동영상에는 전체 대본이 없습니다. 해결법: 중요한 차트에는 내용을 설명하는 alt를 추가하고 동영상에는 transcript를 첨부합니다. 그래야 텍스트만 처리하는 엔진도 콘텐츠를 추출할 수 있습니다.
  • 오류 10|AI에 사이트 지도를 제공하지 않음: sitemap이나 llms.txt가 없으면 AI는 핵심 페이지의 위치를 추측해야 합니다. 해결법: XML sitemap을 관리하고, 가장 인용되기를 원하는 핵심 페이지를 llms.txt에 명확히 표시합니다.

10가지를 한꺼번에 해결하기 어렵다면 이 4가지부터 시작하십시오

리소스가 부족할수록 우선순위는 분명합니다. 먼저 가져올 수 있어야 하고, 다음으로 내용을 이해할 수 있어야 하며, 마지막으로 신뢰할 수 있어야 합니다. AI 크롤러가 완전한 HTML을 가져가는지부터 확인하고(오류 1, 2), 가장 기본적인 Article 및 FAQPage 스키마를 추가한 뒤(오류 4), 표준 URL을 정리합니다(오류 7). 이 4가지만 처리해도 한 번도 인용되지 않던 페이지가 다시 답변 후보로 검토될 가능성이 생깁니다. 이후 신뢰 계층의 세부 항목을 보완하면 됩니다.

AEO의 핵심은 콘텐츠를 더 잘 쓰는 데 있지 않습니다. 이미 충분히 좋은 콘텐츠를 기계가 깔끔하게 가져갈 수 있는 형태로 바꾸는 일입니다.Tenten GEO Team

30일 안에 직접 검증할 수 있는 것

위 10가지 오류 중 절반은 브라우저와 무료 도구만으로 찾을 수 있습니다. 실제로 시간이 드는 일은 어느 문제가 AI 브랜드 노출을 가장 크게 떨어뜨리는지 판단하고, 수정 후 실제 인용으로 이어지는지 확인하는 것입니다. 불필요한 시행착오를 줄이고 싶다면 30분 GEO 진단을 예약할 수 있습니다. 핵심 페이지 3개를 현장에서 점검해 무엇부터 조치해야 하는지 바로 짚어드립니다. Tenten의 GEO 감사에서는 이 10개 항목을 30일 전체 점검 목록으로 확장합니다.

자주 묻는 질문

검색 순위는 높은데 AI 엔진이 콘텐츠를 인용하지 않는 이유는 무엇인가요?
검색 순위가 높다는 것은 Google이 해당 콘텐츠의 관련성을 인정한다는 뜻이지만, AI 엔진에는 별도의 추출 기준이 있습니다. 크롤러가 JavaScript로 만든 빈 껍데기만 가져가거나, 구조화 데이터가 누락되거나, canonical이 충돌하는 경우가 대표적입니다. 콘텐츠를 다시 쓰기 전에 본문이 HTML에 들어 있는지, 스키마가 검증을 통과하는지부터 확인하십시오.
robots.txt에서 AI 크롤러를 허용해야 하나요?
AI 답변에 인용되기를 원한다면 GPTBot, ClaudeBot, PerplexityBot, Google-Extended를 명시적으로 허용해야 합니다. 설정을 변경한 뒤에는 서버 로그를 열어 실제로 200 응답이 반환되는지, 오래된 설정 때문에 자신도 모르게 차단되고 있지는 않은지 확인합니다.
10가지 오류를 모두 고칠 수 없다면 무엇부터 시작해야 하나요?
‘가져올 수 있는가, 이해할 수 있는가, 신뢰할 수 있는가’의 순서로 접근합니다. 먼저 크롤러가 완전한 HTML을 가져가는지 확인하고, Article 및 FAQPage 스키마를 추가한 다음 표준 URL을 정리합니다. 이 4가지만으로도 인용되지 않던 페이지가 AI의 답변 후보 목록에 다시 들어갈 가능성이 생깁니다.

다음 단계

AI 답변에서 우리 브랜드는 얼마나 보일까요?

30분 GEO 진단을 통해 주요 AI 엔진에서의 가시성 격차와 우선 개선 과제를 확인해 보세요.

30분 진단 예약