Google Indexing · SEO · AEO/GEO
구글 색인 방법 · AI 시대 SEO·AEO/GEO 종합 전략 (2026)
기준일: 2026년 7월 21일. 색인·순위·AI 인용은 서로 다른 단계입니다. Google 공식 입장대로 AI 검색도 기존 색인과 품질 시스템을 기반으로 하므로, SEO 기초 위에 AEO/GEO를 쌓는 순서가 맞습니다. 개인·소규모 사이트가 통제할 수 있는 크롤링·사이트맵·내부 링크·canonical부터 Search Console 미색인 대응, AI Agent가 읽을 수 있는 페이지 구조까지 정리했습니다.
최종 업데이트: 2026년 7월 21일 · 작성: 큐레이터 단비
Part 1 · 기초
2026 검색 전략 핵심 결론
2026년 검색 전략은 아래 순서로 봐야 합니다. 각 단계는 이전 단계가 충족돼야 의미가 있습니다.
발견 → 크롤링 → 렌더링 → 색인 → 검색 노출 → AI 인용 → 클릭/전환
- 색인은 검색 결과 후보가 되는 단계일 뿐입니다.
- SEO는 검색 결과에서 잘 노출되고 클릭받는 전략입니다.
- AEO/GEO는 AI 답변에서 정보원·출처·브랜드로 선택되는 전략입니다.
- Google 공식 입장은 AI 검색도 기존 검색 색인과 핵심 품질 시스템을 기반으로 하므로 SEO 기초가 먼저라는 것입니다.
- AI 시대에는 단순 정보 요약 글보다 직접 경험·원본 데이터·명확한 근거·브랜드 신뢰성이 훨씬 중요해졌습니다.
애드센스 수익화·온페이지 SEO·내부 링크와 함께 보려면 구글 애드센스 핵심 전략 · 3-0 색인·SEO·AEO, 색인 전략 3-1, 온페이지 SEO 3-2를 이어서 읽으면 됩니다.
Part 1 · 기초
검색 생태계·파이프라인·AI 인용
2026년에는 검색결과 클릭만이 목표가 아니다. 발견→색인→노출→AI 인용→전환을 한 흐름으로 본다. 세부 1)~3).
1)2026년 검색 생태계의 핵심 변화
기존: 검색어 입력 → 검색결과 목록 → 사이트 클릭. 2026년: 복잡한 질문 → AI가 관련 검색어를 여러 개 생성 → 여러 출처 검색 → 답변 합성 → 출처 인용 → 예약·구매·문의까지 실행.
과거 목표
- 특정 키워드 1위
- 검색 클릭 확보
- 키워드 반복
- 블로그 글 수 증가
- 백링크 수량
- Google만 대응
2026년 목표
- 주제 전체에서 신뢰할 수 있는 출처 되기
- 검색 노출+AI 인용+브랜드 언급+전환
- 검색 의도·엔티티·조건·근거 명확화
- 원본 데이터·직접 경험·도구·사례
- 관련성 있는 링크·브랜드 언급·평판
- Google·Naver·Bing·ChatGPT·Perplexity 등 동시 대응
조사 기준: 2026년 7월 21일 · Google·Bing·OpenAI·Perplexity·Anthropic·네이버·다음·Apple·Brave·DuckDuckGo 공식 자료와 관측 연구 교차 확인.
2)색인·순위·AI 인용은 서로 다르다
색인됐다고 상위 노출되는 것은 아니며, 상위 노출됐다고 AI 답변에 반드시 인용되는 것도 아닙니다.
| 단계 | 의미 | 통제 가능한 핵심 |
|---|---|---|
| 발견 | 검색엔진이 URL 존재를 알게 됨 | 사이트맵, 내부 링크, 외부 링크 |
| 크롤링 | 봇이 URL을 방문함 | robots.txt, 서버 상태, 속도 |
| 렌더링 | HTML·JS를 처리해 콘텐츠를 읽음 | SSR/정적 HTML, JS 오류 제거 |
| 색인 | 검색 DB에 페이지를 저장함 | 콘텐츠 가치, canonical, 중복 방지 |
| 순위 | 특정 검색어에서 노출 순서를 결정 | 검색 의도, 품질, 링크, 브랜드 |
| AI 인용 | AI Overview·AI Mode·ChatGPT 등이 출처로 선택 | 색인, 명확한 근거, 정보 구조, 권위 |
| 클릭·전환 | 방문자가 실제 행동함 | 제목, 브랜드, UX, 독점 가치 |
3)Google AI Overview·AI Mode 출처 조건
Google AI Overviews와 AI Mode의 출처 링크가 되려면 기본적으로 아래 세 가지를 만족해야 합니다. 별도의 「AI 전용 색인 신청」은 필요 없습니다.
- Google에 색인되어 있고
- 일반 검색 결과에 표시될 자격이 있으며
- 검색 스니펫 표시가 허용돼 있어야 한다.
공식 문서: Google AI 기능과 웹사이트 공식 안내
Part 2 · 색인 운영
색인·크롤·사이트맵·GSC 대응
색인 요청·크롤 접근성·사이트맵·내부 링크·canonical·GSC 미색인 대응을 한 운영 챕터로 묶었다. 세부 1)~6).
1)색인 생성 요청은 언제 해야 하나
개별 URL 검사·색인 요청이 필요한 경우
- 새로운 사이트의 홈페이지
- 새로 만든 핵심 콘텐츠
- 내용을 대폭 수정한 중요 페이지
- noindex, canonical, 404, 서버 오류 등을 수정한 페이지
- 오래 기다려도 크롤링되지 않는 핵심 URL
- 검색 결과에 빨리 반영되어야 하는 시의성 페이지
반복 요청이 불필요한 경우
- 동일 URL을 매일 반복 요청
- 글자 몇 개 수정할 때마다 요청
- 저품질 또는 중복 페이지를 요청으로 해결하려는 경우
- 사이트 전체 URL을 하나씩 요청
- Google이 이미 크롤링했는데 색인을 선택하지 않은 페이지
Google은 같은 URL을 반복 요청해도 더 빨라지지 않는다고 명시합니다. 개별 URL은 URL 검사 도구, 다수 URL은 사이트맵을 사용하세요. Google 재크롤링 요청 공식 문서
권장 운영 방식
- 글 발행 → 사이트맵 자동 갱신
- 중요 글 → 내부 링크 2~5개 연결
- 정말 중요한 새 글만 → 색인 생성 요청 1회
- 이후 → 최소 며칠 기다리기
- 계속 미색인 → 요청 반복이 아니라 원인 진단
2)크롤링 접근성
중요 페이지는 아래 조건을 만족해야 합니다.
- HTTP 상태 코드가 200
- 로그인 없이 접근 가능
- robots.txt에서 Googlebot을 차단하지 않음
- noindex가 없음
- CDN·방화벽·봇 차단 서비스가 Googlebot을 막지 않음
- 모바일에서도 동일한 핵심 콘텐츠 제공
- 무한 로딩이나 버튼 클릭 없이 주요 본문 확인 가능
- 서버가 자주 5xx 오류를 내지 않음
- 지나치게 느리지 않음
자주 하는 실수
- robots.txt로 차단한 페이지에 noindex를 넣고 제거될 것으로 기대 — Google이 크롤링하지 못하면 noindex도 확인하지 못할 수 있음
- Cloudflare 등에서 봇 전체 차단
- JavaScript 실행 후에만 본문이 나타남
- 모바일 버전에서 본문·내부 링크 누락
- 페이지는 정상인데 리소스나 API 요청이 차단됨
3)사이트맵 운영
사이트맵에는 검색 결과에 내보내고 싶은 표준 URL만 넣는 것이 좋습니다.
넣을 URL
- 상태 코드 200
- 자체 canonical
- noindex 없음
- 실제 가치 있는 콘텐츠
- 현재 운영 중인 페이지
- 검색 결과에 노출하고 싶은 URL
빼야 할 URL
- 404·410
- 리디렉션 URL
- noindex 페이지
- 중복·필터·정렬 URL
- 검색 결과 페이지
- 관리자·회원·장바구니 페이지
- canonical이 다른 URL을 가리키는 페이지
- lastmod는 실제 본문이 의미 있게 변경됐을 때만 갱신
- priority와 changefreq는 Google이 무시할 수 있음
- 사이트맵 제출은 색인을 보장하지 않고 발견을 돕는 힌트
- robots.txt에도 사이트맵 주소 등록 가능
4)내부 링크 구조
사이트맵보다 실제 구조상 더 중요한 경우가 많습니다.
홈
└─ 핵심 카테고리
└─ 대표 가이드
└─ 세부 질문·사례·비교 글권장
- 홈 → 핵심 카테고리 → 대표 가이드 → 세부 질문·사례·비교 글
- 홈페이지나 카테고리에서 도달 가능
- 가능하면 3~4번 이내 클릭으로 접근
- 다른 관련 글에서 문맥상 연결
- 앵커텍스트 형태 사용 — 링크 문구가 목적지를 설명
피해야 할 것
- 사이트맵에는 있지만 내부 링크가 없는 고아 페이지
- 「여기 클릭」만 반복
- JavaScript 이벤트로만 이동하는 링크
- 중요 페이지를 태그·검색 결과에서만 발견 가능하게 구성
- 모든 페이지에서 수백 개 링크를 기계적으로 출력
내부 링크 수는 고정 정답이 없습니다. 관련성이 중요합니다. 수익·세션 관점의 실전은 애드센스 칼럼 내부 링크 전략을 참고하세요.
5)URL·canonical·중복 관리
같은 내용이 http/https, www/non-www, trailing slash, UTM 파라미터 등 여러 URL로 열리면 크롤링과 평가 신호가 분산됩니다.
- HTTPS 버전 하나로 통일
- www 또는 non-www 통일
- trailing slash 규칙 통일
- 중복 URL은 301 리디렉션
- 각 표준 페이지에 self-canonical
- 내부 링크와 사이트맵은 표준 URL만 사용
- 추적 파라미터가 별도 페이지로 증식하지 않게 관리
Google에서 canonical 신호의 강도
- 리디렉션: 강한 신호
- rel="canonical": 강한 신호
- 사이트맵 포함: 약한 신호
6)Search Console 미색인 상태별 대응
발견됨 — 현재 색인이 생성되지 않음
Google이 URL은 알지만 아직 크롤링하지 않은 상태다.
원인 가능성
- 새 사이트라 신뢰·크롤링 수요가 낮음
- 내부 링크가 약함
- URL이 너무 많이 생성됨
- 서버가 불안정하거나 느림
- 사이트 전체 콘텐츠 가치가 낮아 보임
- 필터·태그·날짜 아카이브가 과다함
대응
- 홈페이지·카테고리에서 링크
- 저가치 URL 생성 제한
- 사이트맵 정리
- 서버 상태 확인
- 중요한 페이지만 남기기
- 외부에서 자연스럽게 언급·링크될 만한 콘텐츠 제작
크롤링됨 — 현재 색인이 생성되지 않음
Google이 읽었지만 색인에 넣지 않기로 한 상태다.
원인 가능성
- 다른 페이지와 내용이 비슷함
- 짧아서가 아니라 추가 가치가 부족함
- AI나 다른 사이트 내용을 재요약한 수준
- 검색 수요 또는 독립 페이지로서의 필요성이 낮음
- 품질이 낮은 자동 생성 콘텐츠
- soft 404로 판단될 정도로 실질 내용이 없음
대응
- 직접 경험·사진·측정값·사례 추가
- 기존 상위 페이지와 무엇이 다른지 명확히 만들기
- 비슷한 글 여러 개를 하나의 강한 글로 통합
- 필요 없는 글은 삭제·리디렉션·noindex
- 제목만 다른 유사 페이지 대량 생성을 중단
색인 요청을 계속 눌러도 콘텐츠 가치 문제가 해결되지는 않습니다. 실전 색인 팁은 애드센스 칼럼 색인 전략도 참고하세요.
기타 상태
중복, Google에서 사용자와 다른 표준 페이지 선택
canonical 신호 충돌 확인, 사이트맵·내부 링크·canonical 통일, 내용이 같으면 통합. 표준 페이지가 색인됐다면 문제 아닐 수 있음
적절한 표준 태그가 포함된 대체 페이지
의도한 canonical이라면 정상
robots.txt에 의해 차단됨
노출하려면 차단 해제. 저가치 URL이면 의도에 따라 유지. robots.txt는 canonical 도구가 아님
noindex 태그에 의해 제외됨
HTML과 HTTP 헤더 모두 확인, CMS 검색엔진 차단 설정 점검
soft 404
내용 없는 페이지는 실제 404/410 반환. 존재하는 페이지라면 실질 콘텐츠 강화
Google도 사이트의 100% 색인을 목표로 삼지 말고 중요한 표준 페이지의 색인 여부를 보라고 안내합니다. Search Console 페이지 색인 보고서
Part 4 · 콘텐츠·AEO
콘텐츠·AEO/GEO·신뢰·스키마·미디어
이 장에서는 범용 콘텐츠를 버리고 AI가 인용하기 쉬운 페이지 구조·E-E-A-T·스키마·미디어·성능까지 한곳에 정리한다. 세부 항목은 1)~8)로 읽으면 된다.
1)2026년 콘텐츠 SEO 전략 — 범용 콘텐츠를 버려라
Google이 최신 공식 가이드에서 반복 강조하는 개념은 non-commodity content, 즉 범용품이 아닌 콘텐츠다. Google 생성형 AI 최적화 공식 가이드
범용 콘텐츠
- 초보자를 위한 7가지 팁
- SEO가 중요한 이유
- 다이어트 방법 총정리
- 홈페이지 제작 시 고려할 사항
- 제품 설명을 재가공한 추천 글
- 여러 상위 글을 하나로 합친 요약
- 실제 사용하지 않고 작성한 제품 후기
비범용 콘텐츠
- 직접 사용한 기간과 조건
- 원본 사진·영상
- 실제 비용 공개
- 실패 사례
- 자체 실험·설문·통계
- 비교 테스트·고객 사례
- 지역 현장 정보·인터뷰
- 계산기·템플릿·진단 도구
- 공개되지 않은 작업 절차
- 기존 통념과 다른 전문적 관점
콘텐츠 발행 전 질문
- 이 글에 다른 사이트에 없는 정보가 있는가?
- 실제 경험이나 검증이 들어 있는가?
- AI가 기존 인터넷 정보만으로 같은 글을 만들 수 있는가?
- 독자가 이 페이지를 방문해야 할 이유가 있는가?
- 사이트 이름을 지워도 작성 주체를 구별할 수 있는가?
마지막 질문에서 구별되지 않는다면 범용 콘텐츠일 가능성이 크다.
예전 방식
- 검색량 높은 키워드 선택
- 키워드를 제목과 본문에 반복
- 비슷한 글을 여러 개 제작
- 상위 글을 정리해 더 길게 작성
2026년 방식
- 특정 이용자의 실제 문제를 해결
- 검색 결과에 이미 없는 정보를 제공
- 작성자가 직접 겪거나 검증한 내용
- 결과뿐 아니라 방법·조건·한계 공개
- 브랜드와 작성자를 확인할 수 있게 구성
- 텍스트뿐 아니라 이미지·영상·도표·데이터 제공
강한 콘텐츠 유형
- 직접 사용 후기와 원본 사진
- 실제 비용·기간·실패 사례
- 비교 실험
- 설문·통계·자체 데이터
- 전문가 인터뷰
- 지역별 실제 정보
- 제품·서비스 사용 과정 영상
- 최신 정책이나 가격을 검증한 표
- 누구나 따라 할 수 있는 구체적 절차
- 계산기·체크리스트·템플릿·도구
- 일반론과 다른 독자적 관점
약한 콘텐츠 유형
- 「초보자를 위한 7가지 팁」식 범용 요약
- 다른 상위 글을 합친 요약
- AI 생성 후 검수하지 않은 글
- 제목만 다른 지역·키워드 페이지
- 제품 설명을 제조사에서 복사한 제휴 글
- 실제 사용하지 않고 쓴 추천 순위
- 통계 출처가 없는 주장
- 날짜만 최신으로 바꾼 글
블로그 수익화와 온페이지 SEO 실전은 애드센스 칼럼 온페이지 SEO·색인·AEO 요약과 함께 보면 좋다.
2)AEO와 GEO는 무엇인가
- SEO — 검색 결과에서 페이지의 노출·순위·클릭을 개선하는 활동.
- AEO (Answer Engine Optimization) — 검색엔진이나 AI가 질문에 답할 때 내 콘텐츠를 답변 근거로 이해하기 쉽게 만드는 활동.
- GEO (Generative Engine Optimization) — Google AI Mode, ChatGPT, Copilot, Perplexity, Claude 등에서 출처로 인용·브랜드로 언급·제품·서비스로 추천·비교 후보로 포함될 가능성을 높이는 활동.
실무에서 AEO와 GEO는 상당히 겹친다. Google은 용어를 부정하지는 않지만, 별도 해킹보다 기존 SEO 기초와 독창적 콘텐츠가 중요하다고 명확히 말한다.
3)AI 답변에 인용되기 좋은 페이지 구성
다음은 보장 공식이 아니라 실무적으로 유리한 형식이다.
- 질문에 대한 짧은 결론 — 본문 시작에서 2~4문장으로 핵심 답을 제공한다.
- 조건과 예외 — 「무조건」보다 어떤 경우에 맞고 틀리는지 명시한다.
- 근거 — 데이터·공식 문서·실제 실험·사례·계산 방법을 붙인다.
- 비교표 — 가격·장단점·대상·조건·결과를 한눈에 보이게 한다.
- 단계별 절차 — 실행 순서를 번호로 표시한다.
- 원본 정보 — 직접 촬영·실측·템플릿·인터뷰·자체 통계를 넣는다.
- 출처와 업데이트 날짜 — 출처 링크·조사 기준일·작성·수정일·작성자·검수자·수정 내역.
중요한 주의사항
- 모든 문장을 잘게 「청킹」할 필요는 없다
- 모든 검색어 변형마다 별도 페이지를 만들 필요도 없다
- FAQ를 억지로 수십 개 넣는다고 AI 인용이 보장되지 않는다
- 「AI가 좋아하는 특별한 문체」는 공식적으로 존재하지 않는다
- 우선 사람이 읽고 이해하기 좋은 구조여야 한다
4)Query fan-out 대응 전략
Google AI Overviews와 AI Mode는 하나의 질문을 여러 관련 검색으로 확장하는 query fan-out을 사용할 수 있다. 예: 「초보자가 집에서 커피머신을 사려면?」 → 종류·캡슐 vs 전자동·청소·유지비·원두 비용·소음·고장률·크기 등을 함께 검색할 수 있다.
페이지를 검색어 변형마다 쪼개지 말고:
- 핵심 주제를 충분히 다루는 대표 가이드
- 비용·비교·문제 해결 같은 세부 페이지
- 페이지 간 강한 내부 링크
- 중복되지 않는 역할 분담
대표: 초보자 커피머신 선택 가이드
├─ 캡슐 vs 전자동 실제 유지비
├─ 청소 난이도 비교
├─ 1년 사용 후기
├─ 고장 증상과 해결법
└─ 소형 주방 설치 사례토픽 클러스터·내부 링크 운영은 애드센스 칼럼 내부 링크 전략과 맞물린다.
5)E-E-A-T와 브랜드·저자 신뢰
E-E-A-T는 단순 체크박스나 독립 점수 하나가 아니다. 다만 신뢰성이 필요한 주제에서는 매우 중요하다. 건강·금융·법률·안전 분야는 출처와 전문 검수가 더 중요하다.
개인이 만들 수 있는 신뢰 신호
- 실제 이름 또는 일관된 필명
- 상세한 저자 소개
- 관련 경력·자격·경험
- 작성자별 프로필 페이지
- 연락처·운영자·회사 정보
- 개인정보처리방침
- 광고·협찬·제휴 공개
- 편집·검수 정책
- 오류 제보 및 수정 절차
- 출처와 조사 방법
- 콘텐츠 수정 기록
- 실제 제품 사용 증거
- 외부의 자연스러운 언급과 링크
상세 실전은 애드센스 칼럼 E-E-A-T를 참고한다.
6)구조화 데이터 전략
구조화 데이터는 검색엔진이 페이지 의미를 이해하고 리치 결과 자격을 판단하도록 돕는다.
| 사이트 유형 | 고려 대상 |
|---|---|
| 일반 글 | Article, BlogPosting |
| 작성자 | Person, ProfilePage |
| 사이트/사업자 | Organization |
| 지역 사업 | LocalBusiness |
| 상품 | Product, Offer |
| 동영상 | VideoObject |
| 레시피 | Recipe |
| 채용 | JobPosting |
| 이벤트 | Event |
| 실제 Q&A | QAPage |
| 탐색 구조 | BreadcrumbList |
원칙
- 화면에 보이는 내용과 일치
- 허위 평점·리뷰 금지
- 존재하지 않는 가격이나 재고 금지
- Google이 지원하는 유형을 우선 적용
- Rich Results Test와 Search Console에서 검사
오해
- 구조화 데이터를 넣는다고 순위가 자동 상승하지 않는다
- AI Overviews를 위한 특별한 Schema는 없다
- FAQ Schema를 넣는다고 FAQ 리치 결과가 보장되지 않는다
- Google AI 검색에는 구조화 데이터가 필수 조건이 아니다
7)이미지·영상·멀티모달 SEO
AI 검색은 텍스트 링크뿐 아니라 이미지와 영상도 활용한다.
이미지
- 직접 촬영·제작한 이미지
- 설명적인 파일명
- 정확한 alt
- 이미지 주변에 관련 설명
- 적정 해상도
- WebP/AVIF 등 효율적 형식
- 원본 이미지에 대한 이용 권한
- 필요 시 이미지 사이트맵
영상
- 독립적인 시청 가치
- 명확한 제목과 설명
- 자막·스크립트
- 썸네일
- 영상 내용을 설명하는 본문
- 핵심 영상이 페이지에서 쉽게 발견되게 구성
- 가능하면 VideoObject
텍스트 글을 AI 음성으로 읽은 영상만 대량 생산하는 방식은 차별성이 약하다.
8)페이지 경험과 성능
Core Web Vitals 권장 기준:
- LCP: 2.5초 이내
- INP: 200ms 미만
- CLS: 0.1 미만
Google Core Web Vitals 공식 안내. 속도 점수만 높다고 저품질 콘텐츠가 상위에 오르는 것은 아니다.
개인 운영자 우선순위
- 모바일에서 본문이 바로 보이는가
- 광고나 팝업이 본문을 가리지 않는가
- 페이지가 안정적으로 열리는가
- 버튼과 링크가 정상 작동하는가
- 이미지 때문에 화면이 흔들리지 않는가
- 불필요한 플러그인과 스크립트가 많은가
- HTTPS와 보안이 정상인가
Part 5 · AI 운영
크롤러·Bing·트렌드·AI 콘텐츠·금지 전략
검색 노출과 AI 학습·인용을 분리해 운영하고, 2026년 트렌드·금지선을 함께 본다. 세부 1)~7).
1)AI 에이전트 시대의 사이트 준비
2026년에는 AI가 정보를 읽는 것을 넘어 예약·구매·비교 같은 행동까지 수행하는 방향으로 진행되고 있다. Google web.dev 최신 권장사항:
- 실제 버튼은 <button> 사용
- 링크는 <a> 사용
- 입력란과 <label> 연결
- 접근성 트리 정리
- DOM 구조를 명확하게 구성
- 화면 배치가 갑자기 변하지 않도록 함
- 투명 오버레이로 요소를 가리지 않음
- 선택·장바구니·예약 결과를 명확하게 표시
시맨틱 HTML과 접근성 개선이 인간 사용자뿐 아니라 AI 에이전트에도 도움이 된다. AI 에이전트 친화적 사이트 가이드
2)AI 크롤러 정책
검색 노출과 AI 학습 허용은 분리해서 결정할 수 있다.
Googlebot / Google-Extended / nosnippet·max-snippet
검색 노출과 학습·그라운딩 제어는 분리 가능. Google-Extended 차단 ≠ 검색 색인 차단
OpenAI
OAI-SearchBot / GPTBot / ChatGPT-User
검색 노출만 원하면 OAI-SearchBot 허용·GPTBot 차단 검토
Anthropic
Claude-SearchBot / ClaudeBot / Claude-User
검색용·학습용·사용자 요청용을 구분
OpenAI: 크롤러 공식 문서 · Anthropic: 크롤러 공식 안내
AI 유입이 목표라면 검색용 봇까지 무조건 차단하면 안 된다. 독점 콘텐츠라면 검색용·학습용·사용자 요청용 봇을 구분해 정책을 세운다.
3)llms.txt는 해야 하나
- Google은 공식적으로 Google 검색과 생성형 AI 검색에 llms.txt를 사용하지 않는다고 밝혔다
- 생성형 AI 노출을 위한 필수 파일이 아니다
- 만들어도 Google에서 특별한 우대가 없다
- 다른 일부 도구·실험 생태계에서 쓸 가능성은 있으나 검증된 표준으로 보기 어렵다
개인 운영자 우선순위
- robots.txt
- 사이트맵
- 검색 가능한 HTML
- 내부 링크
- 고유 콘텐츠
- 구조화 데이터
- 그 이후 여유가 있을 때 llms.txt 실험
4)Bing·Copilot·IndexNow 전략
- Bing Webmaster Tools 등록
- 사이트맵 제출
- Bingbot 접근 허용
- IndexNow 활성화
- Bing Places 등록
- AI Performance 확인
IndexNow는 페이지 생성·수정·삭제를 참여 검색엔진에 빠르게 알리는 프로토콜이다. Bing 및 참여 엔진에 유용하고, Google 일반 웹페이지 색인 대체 수단은 아니다. 한 번에 최대 10,000 URL. 쇼핑몰·가격·재고·뉴스·채용·이벤트에 특히 유용하다. IndexNow 공식 문서
- Bing Webmaster Tools 등록
- 사이트맵 제출
- IndexNow 활성화 (자주 바뀌는 상품·가격·재고·뉴스에 특히 유용)
- Copilot·AI Performance에서 인용 페이지·grounding query 확인
- IndexNow는 Google 일반 웹 색인 대체 수단이 아님
2026년 Bing Webmaster Tools에는 AI Performance(공개 미리보기)로 총 인용 수·인용 페이지·grounding query·시간별 추이를 확인할 수 있다. Copilot·Bing AI 요약·일부 파트너 포함. Bing AI Performance 공식 발표
5)2026년 최신 AI 검색 트렌드
1. 검색 순위보다 「출처 선택」
AI는 1위 페이지 하나만 보여주지 않고 여러 검색을 수행해 다수 출처를 합성한다. 대표 키워드 1위만 노리기보다 여러 세부 질문에서 신뢰할 수 있는 출처가 되는 전략이 중요하다.
2. 전통 순위는 중요하나 완전 일치하지 않음
Semrush 등 연구에서 AI 인용과 Google 상위 결과 사이에 상당한 상관이 있었지만, 항상 동일 URL을 인용하지는 않았다. 같은 신뢰 도메인의 더 깊은 세부 페이지를 인용하기도 한다. 도메인 신뢰 + 세부 페이지의 정확한 관련성이 함께 필요하다.
3. 정보형 검색의 클릭 감소
Pew Research: AI 요약 없는 검색 클릭 약 15% vs 있는 경우 약 8%, AI 요약 안 출처 링크 클릭 약 1%. Pew 연구. Ahrefs 관측에서는 AI Overview가 있는 정보형 검색 1위 CTR이 예상치보다 평균 약 58% 낮게 나타났다(업종별 절대값은 아님). Ahrefs CTR 연구
대응 — 사이트에 들어와야만 얻을 수 있는 것:
- 원본 데이터
- 계산기
- 템플릿
- 상세 비교표
- 실제 사례
- 다운로드 자료
- 커뮤니티
- 개인화 결과
- 도구와 기능
4. 인용과 트래픽 분리
AI가 많이 인용해도 방문자를 많이 보내지 않을 수 있다. Cloudflare crawl-to-refer. 페이지뷰뿐 아니라 브랜드 언급·보조 전환도 측정해야 한다.
5. 브랜드·커뮤니티·영상
AI는 Reddit·YouTube·포럼·리뷰·뉴스·정부·전문 문서도 참고한다. 가짜 후기·인위적 언급 대량 생성은 위험하다.
6. Google Preferred Sources
사용자가 선호 출처로 선택하면 Top Stories뿐 아니라 AI Mode·AI Overviews에도 선호 배지가 표시될 수 있다. 구독·SNS·CTA를 함께 활용할 수 있다. Preferred Sources 공식 가이드
6)AI 콘텐츠 사용 원칙
AI로 글을 썼다는 이유만으로 자동 페널티가 나는 것은 아니다. 문제는 대량 자동 생성·검수 없음·원본 가치 없음·재조합·순위 조작 목적·부정확 정보·키워드별 유사 페이지다. Google은 가치 없는 대량 생성은 scaled content abuse에 해당할 수 있다고 명시한다. Google 스팸 정책
안전한 AI 활용
- 자료 정리
- 초안
- 목차 생성
- 맞춤법 교정
- 데이터 분류
- 질문 후보 발견
- 표 형식 변환
사람이 반드시 할 부분
- 사실 검증
- 직접 경험 추가
- 출처 확인
- 결론과 판단
- 최신성 점검
- 저작권 확인
- 전문 분야 검수
7)하면 안 되는 전략
- 색인 요청 매일 반복
- AI 글 수백 개 자동 발행
- 키워드별로 거의 같은 페이지 생성
- 지역명만 바꾼 페이지 대량 생성
- 백링크 구매
- 댓글·포럼 스팸
- 가짜 리뷰
- 허위 저자·자격
- 다른 사이트 글 번역 후 재발행
- 오래된 글의 날짜만 변경
- 숨겨진 키워드
- 콘텐츠와 다른 구조화 데이터
- 만료 도메인을 사서 무관한 콘텐츠 게시
- 유명 사이트의 하위 폴더를 빌려 순위 조작
- 검색 결과를 자동 수집해 재가공
- 일반 글에 Google Indexing API를 편법 사용
Google Indexing API는 일반 블로그용이 아니라 기본적으로 JobPosting 또는 라이브 방송 BroadcastEvent 일부 페이지 용도다. Indexing API 범위
Part 5 · 실행
우선순위·KPI·루틴·최종 결론
개인 운영자가 바로 실행할 우선순위·측정·주간 루틴과 최종 결론이다. 세부 1)~4).
1)개인 운영자용 실전 우선순위
1단계: 색인 기반
- Search Console·Bing Webmaster Tools 등록
- HTTPS·사이트맵·robots.txt·self-canonical
- 모바일 본문 확인
- 404·리디렉션·서버 오류 정리
- 중요 페이지 내부 링크 연결
2단계: 콘텐츠 정리
유지·강화
- 검색 노출 가치 있음
- 직접 경험이나 독창성 있음
- 전환 또는 브랜드 가치 있음
통합
- 비슷한 글이 여러 개
- 서로 키워드를 잠식
- 각각의 내용이 얇음
삭제·noindex
- 태그·필터·검색 결과
- 내용 없는 페이지
- 오래된 이벤트
- 중복 페이지
- 검색 가치 없는 개인용 페이지
3단계: 대표 콘텐츠
- 대표 가이드 1개
- 비교 글
- 실제 사례
- 문제 해결 글
- 비용·가격 글
- 최신 변경사항
- 원본 이미지·영상
- 도구·템플릿
4단계: AEO 강화
- 시작 부분에 명확한 답
- 질문형 소제목
- 조건·예외
- 단계별 절차
- 비교표
- 숫자와 출처
- 작성자 정보
- 수정일·조사 기준일
- 관련 세부 페이지 연결
5단계: 외부 존재감
- 유튜브·업종 커뮤니티·실제 SNS
- 뉴스레터·전문가 인터뷰·협업 콘텐츠
- 관련 기관·협회·디렉터리
- 지역 사업이면 Google Business Profile과 Bing Places
링크를 얻기 위한 스팸이 아니라 실제 이용자와 만나는 채널로 운영해야 한다.
2)측정해야 할 KPI
색인 KPI
- 중요 URL 색인율
- 새 글 발행 후 최초 크롤링·색인까지 시간
- 발견됨 / 크롤링됨-미색인 추이
- Google 선택 canonical 불일치
- 사이트맵 제출 URL 대비 색인 URL
SEO KPI
- 검색 노출·클릭·CTR·평균 순위
- 브랜드 검색량
- 상위 3위·10위 키워드
- 페이지별 전환
- 재방문·구독
AI/AEO KPI
- Google 생성형 AI 노출
- Bing/Copilot 인용 수
- ChatGPT·Perplexity·Claude 추천 유입
- AI가 인용한 URL·브랜드 언급
- AI 유입 전환율
- 인용됐지만 클릭되지 않는 주제
- AI 답변에서 브랜드 설명 정확도
Search Console에는 일부 사이트 대상 생성형 AI 성능 보고서가 단계적으로 제공된다(모든 속성 아님). 생성형 AI 성능 보고서
3)가장 현실적인 주간 운영 루틴
매주
- 새 핵심 콘텐츠 1개 또는 기존 글 1개 대폭 개선
- 관련 내부 링크 추가
- Search Console 급락·오류 확인
- 실제 사용자 질문 수집
- AI 답변에서 내 브랜드·주제 직접 확인
- 오래된 가격·정책·제품 정보 갱신
매월
- 색인 대상 URL 목록과 실제 색인 비교
- 중복·저가치 페이지 정리
- 성과 좋은 페이지의 세부 주제 확장
- AI 인용 페이지 분석
- Google/Bing/AI 유입 전환 비교
- 브랜드·저자·사업자 정보 최신화
분기별
- 콘텐츠 전체 감사·통합·삭제·리디렉션
- 사이트 구조 개선
- 검색 결과에 없는 정보 조사
- 원본 데이터·사례 콘텐츠 제작
- AI 크롤러 정책 검토
- 구조화 데이터·Core Web Vitals 검사
4)최종 결론
2026년 검색 대응은 단순히 「SEO 글을 잘 쓰는 것」이 아니다.
검색엔진이 수집할 수 있는 기술 기반 + 사람이 신뢰할 수 있는 원본 콘텐츠 + AI가 이해할 수 있는 명확한 정보 + 외부에서 확인되는 브랜드 평판 + 실제 행동으로 연결되는 사이트 구조가 필요하다.
개인이 집중할 순서:
- 검색엔진이 안정적으로 읽을 수 있게 만들기
- 중요한 표준 URL만 색인 대상으로 관리하기
- 사이트맵보다 내부 링크와 페이지 가치 강화하기
- 누구나 AI로 만들 수 있는 요약 글을 줄이기
- 직접 경험·원본 데이터·사례·도구 만들기
- 질문에 명확히 답하되 조건·근거·예외 제공하기
- 저자·브랜드·사업자 신뢰 정보 구축하기
- Google뿐 아니라 Bing·ChatGPT·Claude 크롤러도 구분 관리하기
- 순위·클릭뿐 아니라 AI 인용·브랜드 언급·전환 측정하기
- 색인 생성 요청은 핵심 페이지에만 한 번 사용하기
과거에는 「검색어에 맞는 페이지」가 중요했다면, 2026년에는 여러 검색엔진과 AI가 안심하고 사용하는 원본 출처·브랜드·엔티티가 되는 것이 중요하다. SEO와 AEO는 별개가 아니라 좋은 기술 SEO → 안정적 색인 → 주제별 노출 → AI 출처 후보 → 인용·브랜드 언급 → 클릭·예약·구매로 연결된다.
트래픽을 애드센스 수익으로 연결하는 법은 구글 애드센스 핵심 전략 칼럼에서 이어진다.
Part 3 · GSC
2026년 Search Console 생성형 AI 설정
Search Generative AI Control
Search Console → 설정 → Search generative AI에서 AI Overviews·AI Mode·Discover 생성형 AI 기능에 사이트를 포함하거나 제외할 수 있다(일부 사이트 단계적 제공).
- 기본값은 포함
- 제외하면 AI 답변의 링크·grounding 출처가 될 수 없음
- 일반 검색 순위와는 별도
- AI 학습 통제는 Google-Extended가 담당
Google Search Generative AI Control
생성형 AI 성능 보고서
일부 속성에 AI 노출 수·나타난 URL·국가·기기·날짜별 추이가 제공된다. 아직 모든 사이트에 공개된 것은 아니다.
Part 4 · 플레이북
AEO 주의·작성 템플릿·포트폴리오·유튜브·브랜드·백링크
1)Google AEO/GEO에서 하지 않아도 되는 것
Google이 공식적으로 불필요하거나 위험하다고 밝힌 방향이다.
llms.txt
- Google 검색과 생성형 AI 검색에서 사용하지 않음
- AI 노출 필수 파일이 아님
- 만들어도 Google이 특별히 우대하지 않음
지나친 콘텐츠 청킹
- 문장을 무조건 1~2줄로 쪼갤 필요 없음
- 페이지를 AI 인용 단위에 맞춰 기계적으로 분해할 필요 없음
- 적절한 문단·제목 구조면 충분
AI 전용 문체
- 모든 제목을 질문형으로 만들 필요 없음
- 모든 문단에 「정답:」을 붙일 필요 없음
- exact-match 키워드를 반복할 필요 없음
- 검색어 변형마다 페이지를 만들 필요 없음
특별한 AI Schema·가짜 언급
- AI Overviews 전용 Schema는 없음
- 구조화 데이터는 일반 검색 이해·리치 결과용이며 AI 인용을 보장하지 않음
- 포럼·댓글·SNS 인위적 브랜드 반복, 가짜 후기, 저품질 보도자료, 자동 커뮤니티 게시물은 스팸 신호가 될 수 있음
2)콘텐츠 작성 템플릿
권장 구조다. 콘텐츠 성격에 맞게 쓰고, 억지 FAQ·억지 표·불필요하게 긴 글은 피한다.
H1: 사용자의 핵심 질문 또는 주제 요약: 결론 · 적용 대상 · 핵심 조건 · 조사 기준일 H2: 결론이 나온 이유 (근거·데이터·직접 경험) H2: 조건별 차이 (예산·대상·상황) H2: 비교 (표·장단점·총비용) H2: 실행 방법 (준비 → 실행 → 확인) H2: 예외와 주의사항 H2: 출처와 조사 방법 작성자 · 최초 작성일 · 최종 수정일
3)블로그 콘텐츠 포트폴리오
검색어별 글을 무작정 늘리지 말고 역할별로 제작한다. 아래 비율은 절대 공식이 아니라 일반론 글만 쌓이는 것을 막는 예시이다.
| 역할 | 설명 | 예시 비율 |
|---|---|---|
| 대표 가이드 | 주제 전체를 설명하는 허브 페이지 | 15% |
| 직접 경험 | 사용·방문·작업 과정·실패 사례 | 25% |
| 비교·선택 | 제품 A/B, 비용, 장단점, 대상별 추천 | 20% |
| 문제 해결 | 오류·고장·거절·실패·주의사항 | 20% |
| 데이터 | 설문·통계·실험·가격 추적 | 10% |
| 최신 정보 | 정책·가격·서비스 업데이트 | 10% |
거래형(상담·견적·예약·구매) 콘텐츠도 포트폴리오에 포함한다.
4)유튜브·영상 전략
Ahrefs 관측 연구(75,000개 브랜드·AI Overview 인용 분석)에서는 YouTube 제목·설명·자막의 브랜드 언급과 AI 가시성 사이 상관이 나타났다. AI Overview 인용 URL 중 상위 10 블록과 겹치는 비율은 약 38%였고, 상위 100위 밖 인용에서 YouTube 비중이 크게 관측됐다. 상관관계이지 인과 증명은 아니다.
Ahrefs AI 인용·검색 순위 · Ahrefs 브랜드 가시성
- 원본 영상 제작
- 영상 제목에 실제 주제 명시
- 설명란에 요약·출처·공식 페이지 연결
- 정확한 자막 제공
- 제품명·브랜드명 표기 통일
- 영상 내용을 정리한 웹페이지 운영
- 영상과 글에서 가격·조건이 충돌하지 않게 관리
- Shorts만이 아니라 검색 의도를 해결하는 상세 영상도 제작
5)브랜드·엔티티 전략
AI 검색에서는 페이지 한 장보다 「이 브랜드가 무엇으로 알려져 있는가」가 중요해지고 있다.
브랜드 엔티티 일관성
- 공식 브랜드명·한글·영문 표기
- 사업 분야·대표자·작성자
- 주소·전화번호
- 공식 SNS·유튜브
- 제품명·모델명·서비스 지역
실제 브랜드 언급 확보
- 전문 매체 인터뷰
- 업계 협회·기관
- 파트너·고객 사례
- 유튜브 리뷰·팟캐스트
- 지역 매체·연구·데이터 인용
- 오픈소스·무료 도구
- 행사·발표 자료
링크 구매보다 다른 사람이 브랜드를 구체적 문맥에서 언급하는 것이 중요해지고 있다.
6)백링크 전략 (2026)
여전히 유효한 링크
- 관련 업계 사이트
- 실제 취재·인용
- 기관·협회
- 원본 데이터 출처 링크
- 고객·파트너 사례
- 지역 언론·전문 블로그
- 도구·자료를 소개하는 링크
위험한 링크
- 유료 링크 패키지·PBN
- 자동 댓글
- 무관한 해외 디렉터리
- 키워드 앵커 반복·숨겨진 링크
- 대량 보도자료 복제
- 사이트와 무관한 게스트 포스트
- 만료 도메인 악용
링크 수보다 관련성·주변 문맥·브랜드명 언급·작성자 신뢰·실제 이용자가 볼 가능성·링크 없이도 자연스럽게 언급되는지를 본다.
수익화 관점의 백링크 기초는 애드센스 칼럼 백링크도 참고한다.
멀티엔진 · 해외
해외 AI 검색 대응 (ChatGPT~Brave)
1)ChatGPT Search 대응
| 봇 | 용도 |
|---|---|
OAI-SearchBot | ChatGPT 검색 결과 노출 |
GPTBot | AI 모델 학습 |
ChatGPT-User | 사용자가 요청한 페이지 방문 |
OAI-AdsBot | ChatGPT 광고 랜딩페이지 검증 |
검색 노출은 원하고 학습은 원하지 않는 예
User-agent: OAI-SearchBot Allow: / User-agent: GPTBot Disallow: /
- OAI-SearchBot을 막으면 ChatGPT 검색 답변의 일반 출처로 나타나기 어려워진다
- GPTBot을 막아도 OAI-SearchBot을 허용하면 검색 노출은 가능하다
- WAF가 OpenAI 공식 IP를 차단하지 않는지 확인
실무 전략
- 검색 가능한 HTML 제공
- 핵심 정보는 로그인 전 공개
- 브랜드·제품명이 일관적
- 가격·정책·날짜 명시
- 원본 데이터·공식 설명 페이지
- 외부의 자연스러운 브랜드 언급
- 비교 질문에 필요한 장단점·대상·제한 조건
- AI가 잘못 설명하기 쉬운 항목에 공식 FAQ
- GA4에서 chatgpt.com 추천 유입 측정
ChatGPT는 자체 검색과 외부 소스를 복합 활용하므로, 전용 해킹보다 전체 웹 신뢰도를 높이는 것이 중요하다. OpenAI 크롤러 공식 문서
2)Perplexity 대응
PerplexityBot— 검색 결과에 사이트 표시(기초 모델 학습용이 아님)Perplexity-User— 사용자 질문에 따른 실시간 방문
- PerplexityBot 허용
- WAF에서 공식 IP 확인
- 최신 정보에 명확한 날짜 표시
- 주장을 근거와 직접 연결
- 원본 출처 링크
- 표·정의·비교·절차 제공
- 업데이트 URL을 사이트맵·IndexNow로 알림
- 페이지 제목과 본문 결론 일치
- 학술·기술 콘텐츠는 방법론과 한계 제공
출처 인용을 전제로 한 답변이 많으므로 검증 가능한 문장과 최신성이 특히 중요하다. Perplexity 크롤러
3)Claude 검색 대응
Claude-SearchBot— 검색 결과 품질·색인Claude-User— 사용자 요청 방문ClaudeBot— 모델 학습
User-agent: Claude-SearchBot Allow: / User-agent: Claude-User Allow: / User-agent: ClaudeBot Disallow: /
Claude-SearchBot을 차단하면 Claude 검색에서 가시성·정확도가 낮아질 수 있다. Anthropic 크롤러
4)Apple Search·Siri·Safari 대응
Applebot— Spotlight·Siri·Safari 검색 및 일부 AI 답변Applebot-Extended— Apple 생성형 모델 학습 관련 통제
User-agent: Applebot Allow: / User-agent: Applebot-Extended Disallow: /
Apple이 공개한 순위 요소 예: 검색어와 주제 관련성, 사용자 반응, 외부 링크 수·품질, 대략적 위치, 페이지 디자인. Applebot을 따로 지정하지 않으면 Googlebot 규칙을 참고할 수 있다. Applebot 공식 문서
5)DuckDuckGo 대응
DuckDuckBot— 일반 검색 관련DuckAssistBot— AI 보조 답변용 실시간 크롤러
DuckAssistBot 차단은 일반 검색 순위에는 영향이 없지만 AI 답변 출처는 제한한다. AI 답변 노출을 원하면 Allow. Bing SEO 기반도 함께 관리하는 것이 유리하다.
6)Brave Search 대응
- Brave 크롤러는 별도의 식별 가능한 User-Agent를 항상 공개하지 않을 수 있음
- Googlebot이 접근할 수 없는 페이지는 Brave도 크롤링하지 않을 수 있음
- 삭제는 noindex 사용
- URL 재수집 제출 기능 제공
Brave 전용 SEO보다 Googlebot 접근성·표준 noindex·검색 가능 HTML·내부 링크·웹 표준을 지키는 것이 중요하다. Brave Search Crawler
멀티엔진 · 국내
네이버·다음 검색 대응
4)다음·카카오 검색·티스토리
- Daum 검색등록
- 사이트명·URL·설명 등록
- robots.txt 허용
- 사이트맵·RSS 제공
- 올바른 HTTP 상태 코드
- 중복·빈 페이지 정리
티스토리
다음 생태계와 연결돼 있지만 모든 글이 자동 상위 노출되는 것은 아니다.
- 고유 콘텐츠
- 명확한 카테고리
- 본문 HTML 가독성
- 제목·설명
- 사이트맵·외부 검색엔진 등록
- 중복 스킨 URL 방지
- 광고가 본문을 방해하지 않도록 구성
AI 운영 · 실행판
robots·측정·90일 계획·우선순위 최종판
1)AI 크롤러 권장 robots.txt 예시
검색 노출은 허용하고 모델 학습은 제한하려는 경우의 예다. 사업·저작권 정책에 맞춰 결정한다.
User-agent: Googlebot Allow: / User-agent: OAI-SearchBot Allow: / User-agent: GPTBot Disallow: / User-agent: Claude-SearchBot Allow: / User-agent: Claude-User Allow: / User-agent: ClaudeBot Disallow: / User-agent: PerplexityBot Allow: / User-agent: Applebot Allow: / User-agent: Applebot-Extended Disallow: / User-agent: DuckAssistBot Allow: /
- 사용자 요청형 봇은 robots.txt 적용 방식이 다를 수 있음
- User-Agent만 믿지 말고 공식 IP·역방향 DNS 검증
- Google AI 검색 포함 여부는 Search Console 설정도 확인
- robots.txt로 차단하면 봇이 noindex를 읽지 못할 수 있음
2)측정 체계 (멀티 플랫폼)
- 일반 검색 성능·페이지 색인·크롤링 통계
- Core Web Vitals
- 생성형 AI 성능 보고서
- Merchant Center·Business Profile
Bing·Copilot
- Webmaster Tools
- AI Performance
- IndexNow 상태
- Bing Places
네이버
- 서치어드바이저 수집·색인
- 사이트 진단
- 애널리틱스
- 플레이스·예약·쇼핑
웹 분석 추천 소스 분리
- bing
- naver
- daum
- chatgpt.com
- perplexity.ai
- claude.ai
- copilot.microsoft.com
- gemini.google.com
3)90일 실행 계획
1~2주: 기술 진단
- Search Console·Bing·Naver 등록
- 사이트맵·RSS·robots.txt·canonical·noindex
- 404·5xx·모바일 렌더링·WAF
- AI 크롤러 정책·중복 URL 조사
3~4주: 콘텐츠 정리
- 유지·강화 / 통합 / 리디렉션 / 삭제 / noindex 분류
- 비슷한 글은 하나의 강한 대표 글로 통합
2개월차: 주제 권위
- 대표 가이드·직접 경험·가격·비교
- 실패·주의사항·고객 사례
- 원본 사진·영상·작성자 프로필
- 구조화 데이터·내부 링크 클러스터
3개월차: AI·브랜드 확장
- YouTube·전문가 인터뷰·원본 조사
- ChatGPT·Perplexity·Copilot에서 브랜드 답변 검사
- 인용 경쟁 페이지 분석
- AI 유입·전환 측정
- Agent 친화적 폼·버튼 개선
4)2026년 우선순위 최종판
반드시 해야 하는 것
- 중요한 URL만 안정적으로 색인
- 사이트맵·RSS·IndexNow 활용
- 내부 링크와 주제 구조
- 직접 경험과 원본 정보
- 명확한 작성자·브랜드
- 날짜·가격·재고 최신화
- 출처와 조사 방법
- 모바일 UX·접근성
- AI 검색용 봇 정책 분리
- Google·Bing·Naver·AI 유입 동시 측정
하면 좋지만 2순위
- 지원되는 구조화 데이터
- 원본 영상과 자막
- 무료 도구·계산기
- 자체 조사
- Agent 친화적 인터페이스
- Google Preferred Sources 유도
- Bing AI Performance 분석
우선순위 낮거나 미검증
- llms.txt
- 모든 문단 강제 청킹
- 모든 제목 질문형 변환
- AI 전용 Schema
- 글자 수·키워드 반복 횟수 공식
- 대량 프로그램형 콘텐츠
- 가짜 브랜드 언급
- 색인 요청 반복
- AI 검색결과 수동 확인만으로 성과 단정
Part 6 · AI Agent
AI Agent 준비 체크리스트 19항
답변형·행동형 에이전트가 사이트를 오해 없이 쓰려면 정체성·조건·근거·행동·결과를 모호하지 않게 적어야 한다. 아래 0)~19)는 목차 항목이 아니라 실행 체크다.
0)AI Agent 두 종류와 사이트가 답해야 할 질문
- 답변형 에이전트 — Google AI Mode, AI Overviews, ChatGPT Search처럼 정보를 읽고 요약·인용
- 행동형 에이전트 — 사용자를 대신해 상품 비교, 예약, 장바구니, 문의, 구매 같은 작업을 수행
사이트는 최소한 다음 질문에 답할 수 있어야 합니다.
- 당신은 누구인가
- 무엇을 제공하는가
- 누구에게 적합한가
- 현재 조건은 무엇인가
- 왜 신뢰해야 하는가
- 사용자가 무엇을 할 수 있는가
- 성공 여부를 어떻게 확인하는가
1)사이트·브랜드 정체성
AI가 먼저 알아야 하는 가장 기본적인 정보입니다.
- 공식 사이트 이름이 일관적이다
- 브랜드명 한글·영문 표기가 통일돼 있다
- 회사명과 서비스명이 구분돼 있다
- 한 문장으로 「무엇을 하는 곳인지」 설명되어 있다
- 핵심 서비스·제품 분야가 명확하다
- 주요 대상 고객이 명확하다
- 서비스 가능 지역이 표시돼 있다
- 온라인 전용인지 오프라인 사업인지 알 수 있다
- 공식 전화번호·이메일·주소가 있다
- 사업자 정보가 표시돼 있다
- 공식 SNS·유튜브·앱 링크가 연결돼 있다
- 유사 브랜드와 구분할 수 있는 설명이 있다
권장 문장 예: OO는 서울 지역 소상공인을 대상으로 홈페이지 제작과 검색엔진 최적화 서비스를 제공하는 웹에이전시입니다. 「최고의 디지털 경험을 만드는 혁신적 파트너」처럼 추상적인 표현만 있으면 AI가 정확한 업종과 대상을 파악하기 어렵습니다.
구조화 데이터: Organization, LocalBusiness, WebSite, sameAs, contactPoint, address — 화면에 표시된 실제 정보와 일치해야 합니다.
2)페이지 목적
- 페이지마다 하나의 주된 목적이 있다
- 제목만 보고 페이지 내용을 예측할 수 있다
- H1이 하나의 핵심 주제를 나타낸다
- 첫 부분에 페이지 요약이 있다
- 정보 페이지와 상품·예약 페이지가 구분된다
- 현재 페이지가 공식 정보인지 사용자 후기인지 구분된다
- 작성자 의견과 객관적 사실이 구분된다
- 광고·협찬·제휴 콘텐츠가 명시돼 있다
- 오래된 페이지인지 최신 페이지인지 알 수 있다
- 다음에 해야 할 행동이 명확하다
| 페이지 종류 | AI가 알아야 할 핵심 |
|---|---|
| 정보 글 | 질문, 결론, 근거, 조건, 작성일 |
| 상품 페이지 | 상품명, 가격, 재고, 옵션, 배송, 반품 |
| 서비스 페이지 | 제공 범위, 가격, 기간, 대상, 제외 사항 |
| 비교 글 | 비교 대상, 기준, 조사일, 장단점 |
| 후기 | 실제 사용자 여부, 사용 기간, 협찬 여부 |
| 예약 페이지 | 날짜, 시간, 장소, 인원, 취소 조건 |
| 지역 페이지 | 실제 제공 지역, 주소, 영업시간 |
| 정책 페이지 | 적용 범위, 시행일, 변경일 |
3)콘텐츠의 핵심 답변
- 질문에 대한 직접적인 결론이 있다
- 결론이 페이지 초반에 나온다
- 핵심 용어의 정의가 있다
- 적용 조건이 설명돼 있다
- 예외 상황이 설명돼 있다
- 장점뿐 아니라 단점·한계도 있다
- 숫자에는 단위가 있다
- 가격에는 부가세·배송비 포함 여부가 있다
- 통계에는 조사 시점과 출처가 있다
- 비교에는 동일한 기준이 적용된다
- 단계별 작업 순서가 명확하다
- 최신 정보와 과거 정보가 섞이지 않는다
- 추정·예측·사실이 구분된다
- 결론을 뒷받침하는 근거가 있다
좋은 표현
신청 후 처리 기간은 영업일 기준 3~5일입니다. 주말과 공휴일은 처리 기간에서 제외됩니다.
불명확한 표현
신청 후 빠르게 처리해 드립니다.
4)시간·최신성
- 최초 작성일이 표시된다
- 최종 수정일이 표시된다
- 가격·정책의 적용 기준일이 있다
- 이벤트 시작일과 종료일이 있다
- 영업시간과 휴무일이 있다
- 재고·예약 가능 여부가 최신이다
- 종료된 이벤트는 종료 상태로 변경된다
- 오래된 상품은 단종 여부가 표시된다
- 과거 정보는 아카이브임을 밝힌다
- 수정일만 기계적으로 바꾸지 않는다
- 실제 내용이 변경될 때 사이트맵 lastmod도 갱신된다
권장 날짜 형식: 최종 업데이트: 2026년 7월 21일 / 가격 적용 기준: 2026년 7월 1일 / 신청 기간: 2026년 7월 1일~2026년 8월 31일. 「현재」「최근」「이번 달」만 쓰면 나중에 의미가 불분명해집니다.
6)제품·서비스 정보
행동형 AI Agent가 비교·추천하려면 특히 중요합니다.
- 공식 제품·서비스명이 있다
- 모델명·버전·SKU가 있다
- 제품과 옵션이 구분된다
- 제공 대상이 명확하다
- 적합하지 않은 대상도 설명한다
- 핵심 특징이 구체적이다
- 포함 항목과 제외 항목이 구분된다
- 사용 조건과 제한이 표시된다
- 필요한 준비물이 표시된다
- 결과물과 제공 형식이 명확하다
- 정확한 가격 또는 가격 범위가 있다
- 통화가 표시된다
- 부가세 포함 여부가 있다
- 배송비·설치비·수수료가 구분된다
- 정기 결제 여부와 결제 주기가 있다
- 할인 적용 조건·종료일이 있다
- 환불 가능 조건이 있다
- 재고 있음·품절·예약판매가 구분된다
- 옵션별 재고가 구분된다
- 서비스 제공 지역이 있다
- 예약 가능한 날짜·시간을 확인할 수 있다
- 최소·최대 주문 수량이 있다
- 배송 예상 기간이 있다
- 디지털 상품이면 제공 방식이 있다
구조화 데이터: Product, Offer, AggregateOffer, Service, Review, AggregateRating — 리뷰와 평점은 실제 화면에 표시되고 검증 가능한 것만 사용합니다.
7)비교·추천 기준
- 어떤 사용자를 위한 제품인지 명시한다
- 어떤 사용자에게는 적합하지 않은지 명시한다
- 비교 기준이 사전에 설명돼 있다
- 비교한 제품의 버전과 조사일이 있다
- 가격뿐 아니라 유지비를 포함한다
- 장점과 단점을 함께 제공한다
- 평가 점수의 계산 방식이 있다
- 협찬 제품인지 표시한다
- 직접 사용 여부와 사용 기간이 있다
- 추천 순위가 바뀐 이유를 설명할 수 있다
- 경쟁 제품을 의도적으로 누락하지 않는다
- 지역·예산·수준별 추천 조건이 있다
추천 문장 구조: A는 초기 비용이 낮아 단기 사용자에게 적합합니다. 반면 2년 이상 사용할 경우 소모품 비용을 포함한 총비용은 B가 더 낮습니다. 조건에 따라 결론이 달라지는 구조가 AI 추천에 유용합니다.
8)사용자가 수행할 수 있는 행동
- 구매 가능 여부가 분명하다
- 예약·취소·변경 가능 여부가 분명하다
- 문의·견적 요청 방법이 있다
- 회원가입이 필수인지 표시된다
- 작업 단계가 예측 가능하다
- 각 버튼의 행동이 명확하다
- 실행 전 비용을 확인할 수 있다
- 실행 전 최종 확인 단계가 있다
- 실행 결과가 화면에 명확히 나타난다
- 주문·예약 번호가 제공된다
- 실패했을 때 이유와 해결 방법이 표시된다
- 중복 제출을 방지한다
- 취소·되돌리기 방법이 있다
- 민감한 작업은 사용자 확인 없이 진행되지 않는다
좋은 버튼 문구
- 7월 25일 오후 2시 예약
- 장바구니에 추가
- 월 29,000원 요금제로 변경
- 견적 요청서 제출
좋지 않은 버튼 문구
- 확인
- 진행
- 다음
- 클릭
- 아이콘만 있고 이름이 없는 버튼
9)폼과 입력 항목
AI Agent와 접근성 도구 모두 폼의 의미를 이해할 수 있어야 합니다. label·오류 메시지·제출 결과가 모호하면 행동형 에이전트가 작업을 완료하지 못합니다.
- 모든 입력란에 label이 연결돼 있다
- placeholder만으로 항목을 설명하지 않는다
- 필수·선택 항목이 구분된다
- 입력 형식이 설명돼 있다
- 오류 메시지가 구체적이다
- 오류가 난 항목을 식별할 수 있다
- 자동완성 속성을 적절히 사용한다
- 날짜·시간·통화 형식이 명확하다
- 개인정보 제공 목적이 설명돼 있다
- 동의 항목이 개별적으로 구분된다
- 광고성 정보 동의를 강제로 묶지 않는다
- 제출 후 성공 상태가 표시된다
나쁜 오류 메시지
입력값이 잘못되었습니다.
좋은 오류 메시지
휴대전화 번호는 숫자 10~11자리로 입력해 주세요.
10)시맨틱 HTML·접근성
AI Agent는 화면뿐 아니라 HTML과 접근성 트리를 읽는다. Google web.dev도 시맨틱하고 접근 가능한 구조를 권장한다.
- 페이지 언어가 지정돼 있다
- 제목 구조가 H1→H2→H3 순으로 자연스럽다
- 탐색 영역에 <nav>를 사용한다
- 주요 콘텐츠에 <main>을 사용한다
- 글은 <article>로 구분할 수 있다
- 버튼은 <button>을 사용한다
- 이동 링크는 <a href>를 사용한다
- 표에는 제목과 헤더가 있다
- 이미지에는 정확한 alt가 있다
- 아이콘 버튼에는 접근 가능한 이름이 있다
- 키보드만으로 사용할 수 있다
- 모달의 열림·닫힘 상태가 명확하다
- 숨겨진 요소가 접근성 트리에 잘못 남지 않는다
- 로딩·완료·오류 상태가 전달된다
- 화면 배치가 갑자기 변하지 않는다
12)검색·AI 크롤러 접근성
- 중요 페이지가 HTTP 200을 반환한다
- 중요 페이지에 noindex가 없다
- robots.txt에서 검색봇을 실수로 차단하지 않았다
- self-canonical이 정상이다
- 사이트맵에는 표준 URL만 포함돼 있다
- 로그인 없이 핵심 정보를 볼 수 있다
- JavaScript 실행 전 HTML에도 핵심 정보가 있다
- 모바일에서도 동일한 핵심 콘텐츠를 제공한다
- 방화벽이 정상적인 검색봇을 차단하지 않는다
- 무한 스크롤 콘텐츠에 개별 URL이 있다
- 검색용 AI 봇과 학습용 AI 봇 정책을 구분했다
- 봇 차단 정책이 사업 목적과 일치한다
봇별 정책 검토
- Google 검색:
Googlebot - ChatGPT 검색:
OAI-SearchBot - OpenAI 학습:
GPTBot - Claude 검색:
Claude-SearchBot - Anthropic 학습:
ClaudeBot - Bing/Copilot:
bingbot
AI 검색 유입을 원한다면 검색용 봇을 학습용 봇과 함께 일괄 차단하지 않도록 주의한다.
13)상태 정보
행동형 Agent는 현재 상태를 정확히 알아야 한다.
- 로그인 여부를 판단할 수 있다
- 장바구니 수량이 표시된다
- 선택된 상품·옵션이 표시된다
- 현재 단계와 남은 단계가 표시된다
- 예약 가능·마감 상태가 구분된다
- 결제가 처리 중인지 완료됐는지 표시된다
- 제출 성공·실패 여부가 명확하다
- 오류가 발생해도 기존 입력이 보존된다
- 새로고침 후 중복 결제가 발생하지 않는다
- 가격이나 재고가 변경되면 최종 확인을 요청한다
- 세션 만료 시 이유와 재개 방법을 알려준다
버튼을 눌렀을 때 (1) 무엇이 실행됐는가 (2) 성공했는가 (3) 실패했다면 왜 (4) 다음에 무엇을 해야 하는가가 화면과 HTML에서 명확해야 한다.
14)제한·금지·위험 조건
AI는 「할 수 있는 것」뿐 아니라 「하면 안 되는 것」도 알아야 한다.
- 연령 제한이 있다
- 지역 제한이 있다
- 배송 불가 지역이 있다
- 최대 주문 수량이 있다
- 예약 취소 기한이 있다
- 환불 불가 조건이 있다
- 사용 전 주의사항이 있다
- 법적·안전상 제한이 있다
- 개인정보·민감정보 입력 범위가 제한돼 있다
- 사용자를 대신해 확정하면 안 되는 행동이 구분된다
- 결제·계약 전 사용자 확인 절차가 있다
- 변경 불가능한 작업은 사전에 경고한다
결제·계약·의료·금융·법률 관련 행동은 AI가 추정으로 진행할 수 없도록 명확한 확인 절차가 필요하다.
15)정책 정보
- 이용약관
- 개인정보처리방침
- 쿠키 정책
- 배송 정책
- 교환·반품 정책
- 환불 정책
- 취소·예약 변경 정책
- 정기결제 해지 방법
- 보증·A/S 정책
- 광고·제휴 공개
- 저작권·콘텐츠 이용 정책
- 고객지원 운영시간
- 정책 시행일과 수정일
정책을 긴 법률 문서로만 두지 말고, 핵심 조건을 상품·결제·예약 페이지에서도 보여 주는 것이 좋다.
16)정보 일관성
AI가 혼란을 겪는 가장 흔한 원인이 페이지 간 충돌이다. 정보가 충돌하면 오래됐거나 신뢰도가 낮은 출처를 고를 수 있다.
- 홈페이지와 회사 소개의 브랜드명이 같다
- 상품 페이지와 결제 페이지의 가격이 같다
- 검색 결과 제목과 실제 페이지 내용이 같다
- 구조화 데이터와 화면 정보가 같다
- 영업시간이 모든 페이지에서 같다
- 주소·전화번호가 동일하다
- 할인 조건이 배너와 결제 화면에서 같다
- 재고 상태가 목록과 상세 페이지에서 같다
- 한국어·영어 버전의 핵심 조건이 같다
- 모바일과 데스크톱 콘텐츠가 같다
- 오래된 정책 페이지가 검색에 남아 충돌하지 않는다
17)AI가 인용하기 좋은 근거 단위
- 한 문단에 하나의 핵심 주장
- 주장 바로 옆에 근거
- 숫자에 단위와 기준일
- 표에 비교 기준
- 이미지에 설명
- 인용문에 원출처
- 조사 결과에 표본과 방법
- 경험담에 사용 기간과 조건
- 결론에 적용 대상과 예외
- 출처 링크가 중간 재인용이 아닌 원문
- 업데이트로 바뀐 내용이 명확함
결론: 신규 사이트의 색인은 며칠에서 몇 주가 걸릴 수 있습니다. 동일 URL을 반복 요청해도 크롤링이 더 빨라지지는 않습니다. 다수 URL은 사이트맵으로 제출하는 것이 권장됩니다.
출처: Google Search Central · 확인일: 2026년 7월 21일
18)사이트 유형별 추가 체크
쇼핑몰
- SKU·GTIN·브랜드·모델명
- 옵션별 가격·재고
- 배송비·배송 예정일
- 반품 가능 기간
- 판매자 정보
- 실제 후기와 협찬 후기 구분
- 단종·품절·예약판매 상태
- 최종 결제 금액 확인
지역 사업
- 실제 상호
- 도로명 주소
- 서비스 지역
- 영업시간·휴무일
- 예약 방법
- 주차·교통 정보
- 전화번호
- 지점별 개별 페이지
- Google Business Profile과 정보 일치
콘텐츠·블로그
- 작성자
- 작성·수정일
- 직접 경험 여부
- 출처
- 핵심 결론
- 관련 글 내부 링크
- 광고·제휴 여부
- 오래된 정보 정리
SaaS·온라인 서비스
- 기능 목록
- 지원하지 않는 기능
- 요금제별 제한
- API·연동 범위
- 무료 체험 조건
- 데이터 보관·삭제 정책
- 장애 상태 페이지
- 해지·다운그레이드 방법
- 성공·실패 응답 명확화
예약·여행
- 날짜·시간대
- 시간대 기준
- 이용 가능 인원
- 포함·불포함 항목
- 취소 기한
- 환불 비율
- 미성년자 조건
- 준비물
- 최종 확정 상태
19)AI Agent 준비도 자가 평가·Top 20
| 영역 | 배점 |
|---|---|
| 브랜드·사업자 정체성 | 10 |
| 페이지 목적과 핵심 답변 | 10 |
| 날짜·가격·재고 최신성 | 10 |
| 작성자·출처·신뢰성 | 10 |
| 상품·서비스 조건 | 10 |
| 행동·버튼·폼 명확성 | 10 |
| 시맨틱 HTML·접근성 | 10 |
| 크롤링·색인 가능성 | 10 |
| 상태·오류·완료 표시 | 10 |
| 정책·제한·정보 일관성 | 10 |
판정
- 90~100점: AI 검색·행동 Agent에 매우 잘 준비됨
- 75~89점: 기본은 좋지만 상태·정책·구조 보완 필요
- 60~74점: 답변형 AI는 읽을 수 있으나 행동형 Agent는 불안정
- 40~59점: 정보 충돌과 구조적 불명확성이 큼
- 39점 이하: 사람에게도 혼란스러울 가능성이 높음
최우선 20개만 압축
- 우리는 누구인가?
- 무엇을 제공하는가?
- 누구를 위한 것인가?
- 누구에게는 적합하지 않은가?
- 현재 가격은 얼마인가?
- 추가 비용은 무엇인가?
- 현재 구매·예약 가능한가?
- 이용 지역과 시간이 어디까지인가?
- 포함·제외 사항은 무엇인가?
- 취소·환불 조건은 무엇인가?
- 정보 기준일은 언제인가?
- 누가 작성·검수했는가?
- 주장의 근거는 무엇인가?
- 주요 페이지가 색인 가능한가?
- HTML 구조가 의미론적으로 명확한가?
- 버튼을 누르면 어떤 작업이 실행되는가?
- 실행 전 최종 조건을 확인할 수 있는가?
- 실행 성공·실패를 명확히 알 수 있는가?
- 페이지와 구조화 데이터 정보가 일치하는가?
- 다른 페이지의 가격·정책·주소와 충돌하지 않는가?
AI Agent에게 사이트를 이해시키려면 키워드를 반복하는 것이 아니라, 정체성·대상·조건·가격·날짜·근거·행동·결과를 모호하지 않게 표현해야 한다.
Part 7 · FAQ
자주 묻는 질문
색인됐다고 검색 상위에 노출되나요?
아닙니다. 색인은 검색 결과 후보가 되는 단계일 뿐이고, 순위는 검색 의도·품질·링크·브랜드 등 별도 신호로 결정됩니다. 색인과 순위를 혼동하면 운영 우선순위를 잘못 잡게 됩니다.
Google AI Overview 출처가 되려면 별도 신청이 필요한가요?
아닙니다. Google AI 기능도 기존 검색 색인과 품질 시스템을 기반으로 합니다. 색인되어 있고 일반 검색 결과 자격·스니펫 표시가 허용된 페이지가 전제입니다.
Search Console에서 색인 생성 요청을 매일 해도 되나요?
같은 URL을 반복 요청해도 더 빨라지지 않습니다. 새 핵심 콘텐츠·대폭 수정·오류 수정 후 1회 요청하고, 며칠 기다린 뒤에도 미색인이면 콘텐츠·링크·기술 원인을 진단하세요.
robots.txt로 막은 페이지에 noindex를 넣으면 어떻게 되나요?
Googlebot이 페이지를 크롤링하지 못하면 noindex 태그도 확인하지 못할 수 있습니다. 노출을 막으려면 크롤링 가능 상태에서 noindex를 쓰거나, robots.txt 차단과 목적을 분리해 설계하세요.
사이트맵에 모든 URL을 넣으면 색인이 보장되나요?
아닙니다. 사이트맵은 발견을 돕는 힌트일 뿐입니다. 200·self-canonical·noindex 없음·실제 가치 있는 표준 URL만 넣고, lastmod는 본문이 의미 있게 바뀔 때만 갱신하세요.
「크롤링됨 — 색인 안 됨」은 글 길이 문제인가요?
짧아서가 아니라 추가 가치 부족·중복·재요약 수준·검색 수요 낮음 등이 흔한 원인입니다. 직접 경험·측정·사례를 더하거나 유사 글을 통합·삭제하는 편이 요청 반복보다 효과적입니다.
SEO와 AEO/GEO의 차이는 무엇인가요?
SEO는 검색 결과에서 잘 노출되고 클릭받는 전략입니다. AEO는 답변 근거로 이해하기 쉽게 만드는 활동이고, GEO는 생성형 시스템에서 출처·브랜드·추천 후보로 선택될 가능성을 높이는 활동입니다. 실무에서는 겹치며, Google은 별도 해킹보다 SEO 기초와 독창적 콘텐츠를 강조합니다.
llms.txt를 꼭 만들어야 하나요?
Google은 검색과 생성형 AI 검색에 llms.txt를 사용하지 않는다고 밝혔습니다. 필수 파일이 아니며 특별한 우대도 없습니다. robots.txt·사이트맵·검색 가능 HTML·내부 링크·고유 콘텐츠를 먼저 하세요.
Google-Extended를 막으면 검색에서 사라지나요?
아닙니다. Google-Extended는 일부 Google AI 시스템의 학습·그라운딩 제어용이고, Google 검색 색인(Googlebot) 차단과는 다릅니다. 검색 노출과 AI 학습 허용은 분리해 결정할 수 있습니다.
네이버 AI탭은 웹 SEO만으로 충분한가요?
부족합니다. AI탭은 상품·장소·지도·예약·쇼핑 등 행동형 검색으로 확장 중이므로 서치어드바이저뿐 아니라 네이버 플레이스·쇼핑·스토어 등 버티컬 데이터도 일관되게 최신화해야 합니다.
ChatGPT 검색에만 나오고 학습은 막고 싶으면?
OAI-SearchBot은 허용하고 GPTBot은 Disallow하는 식으로 정책을 분리할 수 있습니다. WAF가 OpenAI 공식 IP를 막지 않는지도 확인하세요.
Search Console에서 생성형 AI를 끌 수 있나요?
일부 사이트는 설정 → Search generative AI에서 AI Overviews·AI Mode 포함 여부를 제어할 수 있습니다. 제외하면 AI 답변 출처가 되기 어렵고, 일반 검색 순위와는 별개입니다. 학습 통제는 Google-Extended입니다.
2026년에도 키워드 반복 SEO가 통하나요?
검색량 키워드만 반복하는 방식은 약해졌습니다. non-commodity content, 즉 직접 경험·검증 데이터·조건·한계·브랜드 신뢰가 더 중요합니다. 애드센스 수익화까지 보려면 애드센스 핵심 전략 칼럼과 함께 보세요.