Tenten AIGEO
블로그로 돌아가기
기술 AEO 구현도입·실행

기술 AEO 감사 체크리스트: AI가 웹사이트를 읽게 만드는 25가지 점검 항목(DIY 버전)

직접 수행할 수 있는 기술 AEO 감사 체크리스트입니다. 25개 점검 항목을 크롤링, 구조, 의미, 신뢰의 네 계층으로 나눠 AI 크롤러가 웹사이트를 읽을 수 있는지 하나씩 확인하고, ChatGPT와 Perplexity에서 브랜드 노출을 가로막는 기술적 공백을 찾아냅니다.

Tenten GEO 팀게시일 2025-09-065 분 소요
AI 크롤러가 빛나는 경로를 따라가며 웹사이트의 기술 구조를 계층별로 파악하는 모습을 상징적으로 표현한 추상 이미지

대부분의 웹사이트가 AI 검색에서 노출되지 않는 이유는 글의 완성도가 낮아서가 아닙니다. AI 크롤러가 사이트에 들어오지 못하거나, 콘텐츠를 깔끔하게 추출하지 못하거나, 해당 브랜드를 식별하지 못하기 때문인 경우가 많습니다. 기술 계층을 통과하지 못하면 아무리 좋은 글도 성과로 이어지지 않습니다. 이 체크리스트는 ‘AI가 웹사이트를 이해하게 만드는 방법’을 직접 확인할 수 있는 25개 항목으로 구체화했습니다. 아래부터 네 계층을 차례대로 점검하면 눈에 띄는 공백 대부분을 찾을 수 있습니다.

AEO(Answer Engine Optimization, 답변 엔진 최적화)는 전통적인 SEO와 기반을 공유하지만, AI 엔진을 위한 단계가 하나 더 필요합니다. AI 엔진은 먼저 페이지를 수집하고, 콘텐츠를 깔끔한 단락으로 나눈 뒤, 각 단락의 주제를 이해해야 합니다. 그런 다음 생성형 답변에서 해당 내용을 인용할지 결정합니다. 이 과정 중 어느 한 단계라도 막히면 ChatGPT, Perplexity, Google AI Overviews에서 보이지 않게 됩니다. 다음 25개 항목은 이 경로에 따라 크롤링, 구조, 의미, 신뢰의 네 계층으로 나눴습니다. 가장 아래 계층부터 시작합니다.

크롤링 계층: AI 크롤러가 들어올 수 있는가(1–6번)

가장 놓치기 쉬우면서도 치명적인 계층입니다. 콘텐츠는 잘 갖춰져 있지만, 운영자가 모르는 사이 robots.txt나 방화벽 설정에서 AI 크롤러를 전부 차단한 웹사이트가 적지 않습니다.

  • robots.txt에서 주요 AI 크롤러(GPTBot, ClaudeBot, PerplexityBot, Google-Extended)를 명시적으로 허용합니다. 악성 봇과 함께 일괄 차단하지 마세요.
  • Cloudflare 또는 WAF의 차단 규칙을 확인합니다. 기본 옵션인 ‘AI 크롤러 차단’을 그대로 사용하면 인용되기를 원하는 엔진까지 손쉽게 막힐 수 있습니다.
  • 핵심 콘텐츠는 서버 측에서 렌더링된 HTML에 포함되어야 합니다. 대부분의 AI 크롤러는 JavaScript를 실행하지 않으므로 프런트엔드에서 렌더링한 콘텐츠를 보지 못합니다.
  • 모든 중요 페이지가 200 상태 코드를 반환하는지 확인하고, 숨어 있는 404와 소프트 404, 연속 리디렉션을 찾아냅니다.
  • sitemap.xml에는 색인되기를 원하는 모든 페이지를 포함합니다. lastmod에는 실제 업데이트 시각을 반영해야 하며, 모든 페이지를 오늘 날짜로 채우면 안 됩니다.
  • 첫 화면의 콘텐츠가 최초 응답에 포함되어 로드되는지 확인합니다. 크롤러가 로딩 표시만 돌아가는 빈 껍데기 페이지를 수집하게 두지 마세요.

실무에서 자주 발생하는 문제는 웹사이트를 프런트엔드 프레임워크로 개편한 뒤, 페이지 전체를 브라우저의 JavaScript로 렌더링하는 경우입니다. 사용자는 문제없이 볼 수 있지만, JS를 실행하지 않는 크롤러가 수집하는 페이지는 거의 비어 있습니다. 먼저 브라우저에서 ‘페이지 소스 보기’를 열어 핵심 콘텐츠가 원본 HTML에 들어 있는지 확인하세요. 이 단계만으로도 문제의 상당 부분을 걸러낼 수 있습니다.

구조 계층: 콘텐츠를 깔끔하게 추출할 수 있는가(7–13번)

AI 엔진은 페이지 전체를 한꺼번에 읽는 대신 콘텐츠를 여러 청크로 나눈 뒤, 질문에 가장 잘 답하는 구절을 인용합니다. 구조가 명확할수록 필요한 내용이 정확히 추출될 가능성이 높아집니다.

  • 페이지마다 H1은 하나만 사용하고, H2와 H3의 상하 구조를 명확히 설계합니다. 큰 글꼴로 제목처럼 보이게 만들거나 제목 단계를 건너뛰지 마세요.
  • 페이지 전체를 div로 겹겹이 쌓기보다 article, section, nav, 제목 태그 등 시맨틱 태그를 활용해 기계가 구조를 읽을 수 있게 합니다.
  • 핵심 답변은 단락의 첫 한두 문장에 배치합니다. AI가 내용을 추출할 때 요점을 바로 파악할 수 있어야 하며, 핵심을 추측하게 만들면 안 됩니다.
  • 목록은 실제 ul과 ol로, 비교 정보는 실제 table로 작성합니다. 스크린샷이나 시각적 편집에만 의존하면 이미지 속 문자를 추출할 수 없습니다.
  • FAQ는 질문과 답변이 짝을 이루는 구조로 작성합니다. 각 답변은 그 자체로 완결되어 독립적으로 인용할 수 있어야 합니다.
  • 이미지에는 내용을 설명하는 alt를 넣고, 동영상에는 전체 대본이나 자막을 추가합니다. 그래야 비텍스트 콘텐츠도 AI가 인식할 수 있습니다.
  • 보일러플레이트 노이즈를 줄입니다. 반복되는 내비게이션, 사이드바 광고, 팝업은 핵심 콘텐츠의 신호 밀도를 떨어뜨립니다.
아래부터 크롤링, 구조, 의미, 신뢰 계층으로 구성된 기술 AEO 감사의 4계층 아키텍처 다이어그램
기술 AEO 감사의 4계층 아키텍처는 아래부터 크롤링, 구조, 의미, 신뢰 순으로 점검합니다.

의미 계층: 기계가 콘텐츠의 뜻을 이해하는가(14–19번)

콘텐츠를 수집하고 깔끔하게 나눌 수 있게 했다면, 다음으로 기계가 ‘이 섹션이 무엇에 관한 내용인지’ 알아야 합니다. 구조화 데이터와 일관된 엔터티 신호는 AI가 콘텐츠에 정확한 표식을 붙이는 데 도움이 됩니다.

  • 페이지 유형에 맞춰 Schema.org 구조화 데이터를 적용합니다. 아티클은 Article, Q&A는 FAQPage, 사용법 콘텐츠는 HowTo, 기업 정보는 Organization을 사용합니다.
  • 구조화 데이터는 JSON-LD 형식으로 작성하고 리치 검색결과 테스트와 스키마 검증 도구를 통과해야 합니다. 구문 오류 때문에 아무도 모르게 무효화되지 않도록 확인하세요.
  • 각 페이지의 제목과 메타 설명이 실제 콘텐츠를 정확히 반영해야 합니다. 가능하면 사용자가 실제로 검색할 질문과 직접 맞닿도록 작성합니다.
  • 엔터티 표기는 사이트 전체에서 일관되어야 합니다. 브랜드, 제품, 인명은 사이트 내부와 외부(Wikipedia, LinkedIn)에서 같은 이름을 사용하고, 영문 대소문자 표기도 통일합니다.
  • 내부 링크에는 내용을 설명하는 앵커 텍스트를 사용합니다. 관련 페이지를 토픽 클러스터로 연결해 크롤러가 페이지 간 관계를 이해하도록 돕습니다.
  • 페이지 하나에는 주제 하나만 다룹니다. 서로 다른 검색 의도 다섯 개를 한 페이지에 욱여넣으면 AI가 콘텐츠를 분류하고 인용하기 어려워집니다.

신뢰 계층: AI가 안심하고 인용할 수 있는가(20–25번)

AI가 출처를 인용하는 행위는 해당 출처를 보증하는 것과 같습니다. 따라서 저자와 근거 출처, 엔터티가 명확한 페이지를 우선 선택하는 경향이 있습니다. 이 계층에서 단순히 ‘읽히는’ 데 그칠지, 실제 출처로 ‘선택될지’가 결정됩니다.

  • 모든 콘텐츠에 저자명과 직함, 저자 페이지를 표시하고, 스키마의 datePublished와 dateModified로 게시일과 수정일을 명시합니다.
  • 핵심 수치와 주장에는 검증 가능한 출처를 연결합니다. AI가 인용하기 전에 내용을 확인할 수 있어야 합니다.
  • 사이트 전체에 HTTPS를 적용하고 유효한 인증서를 사용하며, 혼합 콘텐츠 경고를 해소해 기본적인 신뢰 점수를 잃지 않도록 합니다.
  • 사이트 전체와 Organization 스키마에서 이름, 주소, 전화번호(NAP)를 완전히 동일하게 유지해 엔터티의 신뢰도를 높입니다.
  • llms.txt를 마련하거나 ‘누구이며, 무엇을 하고, 왜 하는지’를 명확히 설명하는 소개 페이지를 준비합니다. AI가 해당 브랜드를 빠르게 이해하는 데 도움이 됩니다.
  • 매월 ChatGPT, Perplexity, Google AI Overviews에서 브랜드 관련 질문을 테스트하고, 인용 여부와 인용 내용의 정확성을 기록합니다.

감사 이후: 개선 작업의 우선순위를 정하는 법

25개 항목을 한꺼번에 해결하려고 하지 마세요. 아래 계층부터 올라가면 됩니다. 먼저 크롤링 계층을 모두 통과시킨 뒤 구조와 의미를 개선하고, 마지막으로 신뢰 신호를 보완합니다. 크롤링 계층은 연결 또는 차단으로 결과가 갈리는 이분법적 영역입니다. 구조와 의미 계층은 점진적으로 개선되므로 하나를 고칠 때마다 상태가 나아집니다. 이 체크리스트는 Tenten의 30일 GEO 감사 중 기술 영역을 직접 점검할 수 있도록 간소화한 버전입니다. 직접 실행해도 눈에 띄는 공백의 약 70%를 찾을 수 있습니다.

점검을 마쳐도 당장 판단하기 어려운 항목이 몇 가지 남을 수 있습니다. 크롤러가 실제로 차단됐는지, 스키마가 제대로 작동하는지, 실측 테스트에서 브랜드가 정확히 인용됐는지 등입니다. 이런 모호한 부분을 한 번에 확인하고 우선순위가 정리된 개선 목록을 받고 싶다면 30분 GEO 진단을 예약하세요. 실제 URL로 한 차례 테스트한 뒤, 가장 먼저 처리해야 할 세 가지 항목을 바로 알려드립니다.

자주 묻는 질문

기술 AEO 감사와 일반 SEO 감사는 무엇이 다른가요?
기술 AEO 감사에는 ‘AI 엔진이 사이트를 이해하고 출처로 인용할 수 있는가’라는 계층이 추가됩니다. AI 크롤러의 차단 여부, 콘텐츠를 깔끔하게 추출할 수 있는지, 구조화 데이터가 유효한지를 별도로 확인합니다. 전통적인 SEO 감사에서는 자주 빠지는 항목입니다.
robots.txt가 AI 크롤러를 차단하면 어떻게 되나요?
robots.txt나 방화벽이 GPTBot, ClaudeBot, PerplexityBot 등의 크롤러를 차단하면 AI 엔진이 콘텐츠를 수집할 수 없습니다. ChatGPT와 Perplexity의 답변에서 완전히 보이지 않게 되며, 이후에 아무리 최적화해도 효과를 얻을 수 없습니다.
25개 항목을 직접 점검할 수 있나요, 아니면 대행사가 필요한가요?
크롤링 계층과 구조 계층의 대부분은 직접 점검하고 개선할 수 있습니다. 다만 스키마 검증, JS 렌더링 판단, 실제 인용 정확도 측정에는 더 많은 경험이 필요합니다. 먼저 체크리스트를 직접 실행해 명확한 공백을 찾은 뒤, 남아 있는 모호한 영역을 컨설턴트와 확인하는 방법을 권합니다.

다음 단계

AI 답변에서 우리 브랜드는 얼마나 보일까요?

30분 GEO 진단을 통해 주요 AI 엔진에서의 가시성 격차와 우선 개선 과제를 확인해 보세요.

30분 진단 예약