AI가 읽기 좋은 웹사이트 구조 체크리스트 17
웹사이트 AI 최적화는 크롤링 접근성, 시맨틱 구조, 콘텐츠 형식, 신뢰 신호 4개 영역의 17개 항목으로 점검하면 됩니다.
AI 크롤러가 못 들어오는 사이트는 아무리 콘텐츠가 좋아도 인용될 수 없습니다. 이 글의 체크리스트 17개 항목을 순서대로 확인하면 우리 사이트가 AI에 읽히는 상태인지 바로 진단할 수 있습니다.
웹사이트 AI 최적화, 무엇부터 점검해야 하나요?
점검 순서는 크롤링 접근성이 가장 먼저이고, 그다음 시맨틱 구조, 콘텐츠 형식, 신뢰 신호 순입니다.
| 카테고리 | 항목 수 | 점검 질문 | 실패 시 결과 |
|---|---|---|---|
| 크롤링 접근성 | 5개 | AI 크롤러가 사이트에 들어와 원문을 읽을 수 있는가 | 인용 후보에서 원천 배제 |
| 시맨틱 구조 | 5개 | AI가 문서의 계층과 구조를 파악할 수 있는가 | 내용 오해, 추출 실패 |
| 콘텐츠 형식 | 4개 | AI가 본문을 토막 단위로 추출할 수 있는가 | 읽혀도 인용되지 않음 |
| 신뢰 신호 | 3개 | AI가 우리를 출처로 선택할 이유가 있는가 | 경쟁 출처에 밀림 |
Search Engine Land의 AI 크롤러 최적화 가이드도 접근 허용, 빠른 응답, 시맨틱 마크업을 같은 순서의 기본기로 제시합니다.
크롤링 접근성: AI 크롤러가 우리 사이트에 들어올 수 있나요?
크롤링 접근성은 robots.txt와 방화벽에서 AI 크롤러를 허용하고 있는지부터 확인해야 합니다.
OpenAI는 학습용 GPTBot과 검색 인용용 OAI-SearchBot을 분리 운영하며, 각 봇의 동작과 차단 방법은 Search Engine Land의 AI 크롤러 정리와 Search Engine Journal의 GPTBot 안내에서 확인할 수 있습니다.
| 번호 | 점검 항목 | 통과 기준 |
|---|---|---|
| 1 | robots.txt의 AI 크롤러 허용 | GPTBot, OAI-SearchBot, ClaudeBot, PerplexityBot 차단 규칙 없음 |
| 2 | CDN·방화벽(WAF) 봇 차단 해제 | 보안 솔루션이 AI 봇 트래픽을 자동 차단하지 않음 |
| 3 | llms.txt 제공 | 사이트 핵심 정보를 AI용으로 요약한 llms.txt 파일 존재 |
| 4 | XML 사이트맵 최신화 | 사이트맵이 최신 URL을 반영하고 서치콘솔에 제출됨 |
| 5 | HTML 원문에 콘텐츠 존재 | 자바스크립트 렌더링 없이도 핵심 텍스트가 소스에 보임 |
특히 5번은 자주 놓칩니다. 상당수 AI 크롤러는 자바스크립트를 실행하지 않으므로, 렌더링 후에만 보이는 콘텐츠는 없는 콘텐츠와 같습니다.
시맨틱 구조: AI가 문서 구조를 파악할 수 있나요?
시맨틱 구조는 제목 계층과 HTML 태그가 문서의 논리를 그대로 드러내는지 점검합니다.
| 번호 | 점검 항목 | 통과 기준 |
|---|---|---|
| 6 | 제목 계층 | 페이지당 H1 1개, H2·H3가 논리적 계층으로 구성됨 |
| 7 | 시맨틱 태그 | header, nav, main, article, footer로 영역이 구분됨 |
| 8 | 표·목록 마크업 | 표는 table 태그, 목록은 ul·ol 태그로 작성됨 |
| 9 | 통이미지 금지 | 가격표, 서비스 설명 등 핵심 텍스트를 이미지에 넣지 않음 |
| 10 | 구조화 데이터 | Organization, Article 스키마가 JSON-LD로 선언됨 |
9번 통이미지는 국내 사이트의 최다 감점 요인입니다. 이미지 속 텍스트는 AI가 읽지 못하므로, 긴 상세페이지 이미지는 텍스트 병기가 필수입니다.
사이트 구조 개편을 포함한 작업 범위는 리드젠랩 웹사이트 GEO 서비스에서 확인할 수 있습니다.
콘텐츠 형식: AI가 본문을 토막으로 추출할 수 있나요?
콘텐츠 형식은 AI가 한 토막만 떼어 가도 완결된 답이 되도록 쓰였는지 점검합니다.
프린스턴 등 연구진의 GEO 논문(arXiv:2311.09735)은 인용, 통계, 출처 보강 같은 콘텐츠 형식 개선만으로 생성형 엔진 가시성이 최대 40% 높아질 수 있다고 보고했습니다.
| 번호 | 점검 항목 | 통과 기준 |
|---|---|---|
| 11 | 질문형 소제목과 직답 | 소제목이 실제 질문을 담고 첫 문장이 완결형 답임 |
| 12 | 짧은 문단 | 한 문단이 1~2문장으로 토막 추출이 쉬움 |
| 13 | 핵심 답 상단 배치 | 페이지 도입부에서 결론을 먼저 제시함 |
| 14 | 날짜 신호 | 발행일과 수정일이 표기되고 주기적으로 갱신됨 |
신뢰 신호: AI가 우리를 출처로 선택할 이유가 있나요?
신뢰 신호는 같은 내용을 다루는 여러 출처 중에서 AI가 우리를 고를 근거를 만드는 항목입니다.
| 번호 | 점검 항목 | 통과 기준 |
|---|---|---|
| 15 | 작성자·회사 정보 | 저자 프로필과 회사 소개 페이지가 명확히 존재함 |
| 16 | 근거 인용 | 통계와 주장에 권위 출처 링크가 붙어 있음 |
| 17 | 브랜드 정보 일관성 | 사이트, SNS, 외부 디렉터리의 회사 정보가 통일됨 |
17번 일관성은 엔티티 신뢰의 기본입니다. 회사명 표기나 서비스 설명이 채널마다 다르면 AI가 정보를 하나로 합산하지 못합니다.
웹사이트 AI 최적화, 어떤 순서로 적용하나요?
적용은 다음 5단계 순서로 진행하며, 접근성 문제를 먼저 풀어야 나머지 투자가 의미를 가집니다.
- 진단한다: 17개 항목을 현재 사이트에 대입해 통과, 실패를 표로 기록한다.
- 개방한다: robots.txt와 방화벽의 AI 크롤러 차단을 해제하고 llms.txt를 올린다.
- 개편한다: 제목 계층, 시맨틱 태그, 통이미지 문제를 템플릿 단위로 수정한다.
- 개선한다: 핵심 페이지부터 질문형 소제목과 직답 구조로 콘텐츠를 다시 쓴다.
- 측정한다: 타겟 질문 세트로 AI 답변 인용 여부를 추적해 개선 효과를 확인한다.
리드젠랩은 자체 AI Citation 분석 플랫폼 SOHA로 5단계의 측정을 수행하고, AVO 5단계 프레임워크로 전체 과정을 운영합니다. 닥터나우, 인라인AI 같은 성과 사례를 실명으로 공개하는 국내 유일의 에이전시이며 대기업, 대형 병원 프로젝트 실적을 보유하고 있습니다.
17개 항목 진단을 포함한 서비스 구성은 리드젠랩 솔루션 페이지에서 확인할 수 있습니다.
자주 묻는 질문
웹사이트 AI 최적화는 SEO와 무엇이 다른가요?
웹사이트 AI 최적화는 검색 순위가 아니라 AI 답변 인용을 목표로 하며, AI 크롤러 허용과 토막 추출 가능한 구조가 추가로 요구됩니다. 기존 SEO 기본기 위에 17개 항목을 얹는 관계로 이해하면 정확합니다.
AI 크롤러를 허용하면 콘텐츠 무단 학습이 걱정되는데 괜찮나요?
학습용 봇(GPTBot)과 검색 인용용 봇(OAI-SearchBot)은 분리되어 있어 선택적으로 허용할 수 있습니다. AI 검색 인용이 목표라면 최소한 검색용 봇은 허용해야 합니다.
llms.txt는 꼭 만들어야 하나요?
llms.txt는 아직 업계 제안 단계의 표준이지만, 비용이 거의 들지 않고 사이트 핵심 정보를 AI에 정리해 주는 효과가 있어 만들어 두는 것을 권합니다. robots.txt를 대체하는 것이 아니라 보완하는 파일입니다.
17개 항목 중 가장 먼저 고쳐야 할 것은 무엇인가요?
가장 먼저 고칠 것은 robots.txt와 방화벽의 AI 크롤러 차단입니다. 접근이 막혀 있으면 나머지 16개 항목을 아무리 잘해도 인용이 발생하지 않습니다.
체크리스트 점검 결과는 어떻게 검증하나요?
점검 결과는 타겟 질문을 AI에 던져 실제 인용 여부를 확인하는 방식으로 검증합니다. SOHA 같은 AI Citation 분석 도구로 개선 전후를 비교하면 항목별 효과를 데이터로 확인할 수 있습니다.
웹사이트 AI 최적화, 17개 항목 진단부터 받아보세요
웹사이트 AI 최적화는 크롤러 개방, 시맨틱 구조, 토막 추출 가능한 콘텐츠, 신뢰 신호까지 17개 항목을 갖출 때 완성됩니다.
절반은 개발 설정, 절반은 콘텐츠 구조의 문제라 마케팅과 개발이 함께 봐야 합니다. 우선순위는 언제나 접근성이 먼저입니다.
리드젠랩은 전략, 테크니컬 엔지니어링, 리서치, 콘텐츠, 디자인, 데이터 분석까지 전 직무를 내재화한 팀입니다. 개발 설정과 콘텐츠 구조에 걸친 17개 항목을 한 조직 안에서 진단하고 수정까지 마무리할 수 있는 이유입니다.
AVO 5단계 프레임워크로 진단부터 재측정까지 이어서 실행하기 때문에 점검이 점검으로 끝나지 않습니다.
우리 사이트는 17개 항목 중 몇 개를 통과할까요? 사이트 개편을 결정하기 전에, 문의를 통해 항목별 통과 여부 진단으로 현재 위치부터 확인해 보세요.