Hugo로 정적 홈페이지를 만들어 Cloudflare Pages에 올린 뒤, 구글·네이버 검색과 ChatGPT·Perplexity 같은 AI 답변에 실리게 하는 실무 정리입니다. 강의(AI Agent와 정적홈페이지 만들기)가 예고만 하고 다루지 않은 부분을 따로 조사했습니다.
Cloudflare는 AI 크롤러 차단 기능을 기본으로 켜는 방향으로 정책을 바꿔 왔습니다. 보도에 따르면 2026년 9월 15일부터 새로 등록하는 도메인은 광고가 붙은 페이지에 한해 학습(Training)·에이전트(Agent) 크롤러가 기본 차단되고, 검색(Search) 크롤러는 허용됩니다.
즉 내 사이트가 AI에 안 보이는 이유가 글이 나빠서가 아니라 문이 잠겨 있어서일 수 있습니다.
Cloudflare 대시보드 → AI Crawl Control에서 현재 어떤 크롤러가 허용·차단돼 있는지
먼저 확인하세요. 무료 요금제에서도 카테고리별로 켜고 끌 수 있습니다.
다만 Cloudflare 공식 문서에는 "모든 요금제에서 자동 작동한다"고만 적혀 있고 기본값이 명시돼 있지 않습니다. 위 날짜와 조건은 TechCrunch 등 2차 보도 기준이므로, 정확한 상태는 반드시 본인 대시보드에서 눈으로 확인하시기 바랍니다.
강의 19분 50초에서 스치듯 언급된 세 단어입니다. 목표가 서로 달라 손대는 곳이 다릅니다.
| 구분 | 목표 | 성공의 모습 |
|---|---|---|
| SEO 검색엔진 최적화 |
구글·네이버 검색 결과 목록에 오르기 | "정적 홈페이지 만들기"로 검색하면 내 글이 나온다 |
| AEO 답변엔진 최적화 |
질문에 대한 답 자체로 뽑히기 | 구글 AI 개요 상자에 내 글이 요약돼 실린다 |
| GEO 생성엔진 최적화 |
AI가 답을 만들 때 근거로 인용하기 | ChatGPT가 답하면서 내 사이트를 출처로 단다 |
셋은 겹치지만 같지 않습니다. Ahrefs 조사에 따르면 ChatGPT가 가장 많이 인용한 페이지의 28.3%는 구글 자연 검색 노출이 아예 없었고, ChatGPT·Gemini·Copilot이 인용한 출처 중 같은 질문의 구글 상위 10위 안에 든 것은 10% 미만이었습니다. 구글에서 잘 나온다고 AI가 인용해 주는 것도, 그 반대도 아니라는 뜻입니다.
반대 방향의 데이터도 있습니다. 구글 AI 개요 인용의 76%는 자연 검색 상위 10위에서 나옵니다. 구글 AI 개요는 SEO의 연장선, ChatGPT 인용은 별개 게임으로 보는 편이 실무에 맞습니다.
글을 아무리 잘 써도 로봇이 못 들어오면 끝입니다. 순서상 가장 먼저 할 일입니다.
OpenAI·Anthropic·Perplexity는 각각 용도가 다른 크롤러를 여러 개 굴립니다. 하나를 막아도 다른 하나는 막히지 않습니다. 이 구분이 2026년 정책의 핵심입니다 — 내 글이 학습 데이터로 쓰이는 건 거부하면서, AI 검색 인용에는 계속 노출될 수 있습니다.
| 봇 이름 | 소속 | 하는 일 | 노출 원하면 |
|---|---|---|---|
GPTBot | OpenAI | 모델 학습용 수집 | 선택 |
OAI-SearchBot | OpenAI | ChatGPT 검색 색인 | 허용 |
ChatGPT-User | OpenAI | 사용자 질문 시 실시간 열람 | 허용 |
ClaudeBot | Anthropic | 수집 | 선택 |
Claude-SearchBot | Anthropic | 검색 색인 | 허용 |
PerplexityBot | Perplexity | 검색 색인 | 허용 |
Google-Extended | Gemini 학습 (검색 색인과 무관) | 선택 |
Google-Extended를 막아도 구글 검색 노출과 AI 개요에는 영향이 없습니다.
학습에만 쓰이는 별도 토큰입니다.
Hugo에서는 static/robots.txt에 넣으면 그대로 배포됩니다.
User-agent: *
Allow: /
# AI 검색·인용 봇 (노출을 원하면 열어 둡니다)
User-agent: OAI-SearchBot
Allow: /
User-agent: ChatGPT-User
Allow: /
User-agent: Claude-SearchBot
Allow: /
User-agent: PerplexityBot
Allow: /
# 학습용 수집 봇 — 원치 않으면 아래 Allow를 Disallow로 바꾸세요
User-agent: GPTBot
Allow: /
User-agent: ClaudeBot
Allow: /
User-agent: Google-Extended
Allow: /
Sitemap: https://내도메인.com/sitemap.xml
Q4 2025에 GPTBot·PerplexityBot·ClaudeBot 차단을 푼 사이트들이 90일 만에 AI 유입 +186%를 기록했다는 보고가 있습니다. 숫자 자체는 업계 자료라 감안해서 보되, 방향은 분명합니다.
강의에서 만든 사이트에 그대로 적용할 수 있는 항목들입니다.
baseURL을 실제 도메인으로 정확히 — 강의 1:02:47에서 다룬 그 설정입니다.
틀리면 사이트맵·정규 URL이 전부 어긋납니다/sitemap.xml로 자동 생성합니다. 접속해서 실제로 뜨는지 확인static/에 두면 그대로 나갑니다description으로 관리rel="canonical" — 같은 글이 여러 주소로 잡히는 걸 막습니다h1은 페이지당 하나, 그 아래 h2·h3 순서대로alt — 접근성이자 검색 신호
형식은 JSON-LD 하나만 쓰면 됩니다. 구글이 권장하고 모든 AI 시스템이 받습니다.
Hugo에서는 layouts/partials/head.html에 넣어 전 페이지에 적용합니다.
<script type="application/ld+json">
{
"@context": "https://schema.org",
"@type": "Article",
"headline": "{{ .Title }}",
"description": "{{ .Description }}",
"datePublished": "{{ .Date.Format "2006-01-02" }}",
"dateModified": "{{ .Lastmod.Format "2006-01-02" }}",
"author": { "@type": "Person", "name": "홍길동" },
"mainEntityOfPage": "{{ .Permalink }}"
}
</script>
효과를 정확히 알고 쓰는 게 좋습니다. 2026년 2월 실험에서 ChatGPT와 Perplexity는 JSON-LD를 의미 단위로 해석하지 않고 그냥 텍스트로 읽는다는 결과가 나왔습니다. 그런데도 권장되는 이유는 구글 쪽 경로 때문입니다 — 구조화 데이터가 구글 AI 개요 노출과 지식 그래프 등재를 돕고, 그게 다시 AI 인용으로 이어집니다. 스키마를 갖춘 페이지가 AI 답변에 실릴 확률이 2.5배라는 조사도 있지만, 이는 상관관계이지 스키마만 붙이면 된다는 뜻은 아닙니다.
타입은 욕심내지 말고 글에는 Article, 소개 페이지에는
Person 또는 Organization, 자주 묻는 질문에는 FAQPage
정도면 충분합니다.
기술 세팅은 하루면 끝나고 그다음부터는 전부 글쓰기입니다. 프린스턴 연구진의 GEO 논문에서 인용 노출을 30~40% 끌어올린 편집 방법이 일관되게 세 가지로 나왔습니다.
AI는 글을 처음부터 끝까지 읽고 요약하지 않습니다. 질문에 답하는 대목만 잘라서 씁니다. 그래서 잘리기 좋게 써야 합니다.
FAQPage 스키마.
AI는 근본적으로 질문·답변 기계입니다조사에 따르면 동향·분석 성격의 글은 인용률 78%인 반면, 교육용 방법 안내는 12%였습니다. "○○ 하는 법"은 이미 널려 있어 AI가 굳이 특정 사이트를 인용할 이유가 없습니다. 직접 해 보고 얻은 수치, 남들이 안 쓴 관점, 겪은 실패가 인용을 부릅니다.
강의를 그대로 따라 만든 사이트라면 여기서 갈립니다. "Hugo 설치법"은 인용되지 않지만, "Hugo Blox로 만들면서 겪은 문제 7가지와 해결"은 인용됩니다.
글을 고치면 날짜를 갱신하세요. AI 검색은 최신 자료를 눈에 띄게 선호합니다.
Hugo의 lastmod가 자동으로 잡히도록 설정해 두면 편합니다.
불편하지만 중요한 사실입니다. AI가 인용하는 출처는 소수 사이트에 몰려 있습니다 — Reddit·위키백과·YouTube·LinkedIn 등 상위 50개 도메인이 전체 인용의 약 68%를 차지합니다. 한국이라면 네이버 블로그·카페, 브런치, 커뮤니티가 비슷한 자리에 있습니다.
그래서 내 홈페이지에 원문을 두고, 같은 내용을 다른 곳에 요약해 퍼뜨리는 방식이 유리합니다. 강의 2분 39초에서 말한 "홈페이지와 SNS의 시너지"가 GEO 관점에서도 그대로 맞는 이야기입니다.
sitemap.xml 제출구글에 등록했다고 네이버에 나오지 않습니다. 네이버 서치어드바이저에 따로 등록해야 합니다.
노출까지 통상 2~4주 걸립니다. 하루 이틀 안 나온다고 뭔가 잘못된 게 아닙니다. 한 달이 지나도 안 나온다면 robots.txt·noindex·방화벽 차단·중복 문서·품질 기준 중 하나입니다.
AI 시대의 필수 파일처럼 소개되지만, Ahrefs·SE Ranking·Trakkr 세 곳의 독립 조사와
구글의 2026년 6월 안내 모두 AI 인용에 측정 가능한 효과가 없다고 결론지었습니다.
만들지 말라는 건 아니지만(비용이 거의 없으니), 이걸 했다고 GEO를 했다고 여기면 안 됩니다.
접근 권한을 정하는 건 robots.txt이고, llms.txt는 안내도에 가깝습니다.
기존 방문자 수만 보면 상황을 잘못 읽습니다. AI 개요가 답을 대신 해 주면서 클릭 없이 노출만 되는 경우가 늘었고, 실제로 트래픽이 최대 40%까지 줄었다는 보고가 있습니다. 노출은 늘었는데 방문은 줄 수 있다는 뜻입니다.
| 무엇을 | 어디서 |
|---|---|
| 검색 노출·클릭·순위 | Google Search Console · 네이버 서치어드바이저 |
| AI 답변에서 내 사이트가 인용되는지 | ChatGPT·Perplexity에 직접 질문해 보기 |
| AI 크롤러가 실제로 들어오는지 | Cloudflare 대시보드의 크롤러 요청 로그 |
| AI 서비스에서 넘어온 방문 | 유입 경로에 chatgpt.com·perplexity.ai |
3~6개월은 꾸준히 해야 의미 있는 변화가 보입니다. 한두 주 만에 판단하지 마세요.
robots.txt·baseURL·사이트맵 확인1~4번은 하루면 끝납니다. 결과를 가르는 건 5번입니다.
로컬 광고 채널의 변천을 이렇게 정리한다 — 블로그 → 플레이스 → 맘카페 → 인스타 → 유튜브·스레드. 채널이 늘수록 효율은 떨어지고 비용은 오르는데, 그다음 자리가 GEO라는 판단이다.
주목할 부분입니다. 본문(1절)의 정의와 GEO의 뜻이 다릅니다.
| 본문 (웹 조사) | 현장 기록 | |
|---|---|---|
| AEO | 질문의 답 자체로 뽑히기 | AI 검색 시 내 콘텐츠가 답변으로 나옴 |
| GEO | AI가 답을 만들 때 근거로 인용하기 | AI 검색 시 내 업장이 추천됨 |
어느 쪽이 맞고 틀리다기보다 목표가 다릅니다. 글을 읽히려는 사람에게는 "인용"이 목표지만, 병원·가게처럼 손님이 찾아와야 하는 곳은 "추천"이 목표입니다. 홈페이지를 사업체 홍보로 쓸 계획이라면 현장 쪽 정의가 더 실전적입니다.
자동화 후 한 달이 안 된 시점에 목표한 키워드 두 개에서 1위를 잡았다고 한다. 다만 본인이 "AI에게 물어보면 항상 같은 답을 주는 건 아니다"라고 단서를 단다.
네이버는 상위 노출 여부에 기준이 있고 페이지뷰도 셀 수 있지만, GEO는 그렇지 않다는 지적입니다.
그래서 두 가지로 대응한다고 한다:
객관적 지표가 없다는 점 때문에 쓸데없는 키워드로 물어보고 "노출이 잘된다"고 주장하는 일이 얼마든지 가능하다고 지적합니다. 네이버처럼 공개된 자료가 없어서 검증이 어렵다는 것입니다. GEO 대행을 맡길 때 어떤 질문으로 측정했는지를 반드시 확인하라는 뜻으로 읽힙니다.
글쓴이가 쓰는 표현으로, 문제를 해결하려는 사람이 순차적으로 어떻게 검색해 나가는지를 뜻합니다.
| 질문 유형 | 예 | 성격 |
|---|---|---|
| 넓은 질문 | "강남역 한의원 추천해 줘" | 파이는 크지만 경쟁이 몰린다 |
| 구체적 질문 | "강남에서 리프팅 잘하는 곳" "울세라 써마지 꼼꼼하게 해주는 데 찾아줘" | 객단가와 전환율이 훨씬 높다 |
그래서 내 분야에서 사람들이 던질 법한 질문을 미리 지도로 그려 두고(키워드 매핑), 그 질문에 답이 될 콘텐츠를 만들어야 한다는 순서입니다. 본문 4절의 "주제 선택"과 같은 이야기를, 업종 언어로 더 구체적으로 말하고 있습니다.
네이버 블로그 대신 티스토리를 권합니다. 기존 네이버 글을 가져와 AI에게 아래 기준을 적용해 달라고 시킨 뒤 옮겨 붙이는 방식을 제안합니다.
H2·H3로 소제목 구분Article 스키마 삽입FAQPage 스키마 삽입본문 3·4절과 거의 그대로 겹칩니다 — 질문형 제목, 결론 먼저, 소제목 위계, FAQ, 출처, 수치, JSON-LD. 영문권 조사에서 나온 항목과 국내 현장에서 굴러온 항목이 독립적으로 같은 결론에 도달했다는 점은 이 항목들의 신뢰도를 높여 줍니다.
다만 본인도 블로그보다 공식 홈페이지에 GEO를 세팅하고 칼럼을 주기적으로 발행하는 쪽이 낫다고 덧붙입니다. 홈페이지가 "본진"이라는 표현을 씁니다.
리뷰 개수를 늘리는 게 아니라 리뷰의 주제를 한곳으로 모으는 전략입니다. AI가 "이 병원은 무엇을 하는 곳"이라고 인식하게 만드는 신호를 흩뜨리지 않겠다는 뜻으로 읽힙니다.
외주로 만든 홈페이지에 SEO·GEO가 통째로 비어 있는 경우가 많다고 지적하면서, 순서를 이렇게 둡니다:
본인이 만든 무료 GEO 진단 사이트도 공개했습니다 — JSON-LD 구조화 데이터와 엔티티 연결성을 분석해 100점으로 점수를 내주는 도구입니다. geo-check-xi.vercel.app
제가 직접 검증해 보지는 않았습니다. 개인이 만든 도구이므로 점수를 절대적으로 받아들이기보다 빠진 항목을 찾는 체크리스트로 쓰는 게 맞겠습니다.
기술 세팅과 콘텐츠까지는 직접 했지만 "신뢰도 높은 도메인에 배포하기"에서 막혔다고 합니다. AI가 인용하려면 내 사이트 밖의 권위 있는 곳에 내용이 퍼져 있어야 하는데, 이게 개인이 하기 어렵다는 것입니다.
본문 4절의 "내 사이트 밖도 중요합니다"와 정확히 같은 문제입니다. 제 조사에서는 상위 50개 도메인이 AI 인용의 약 68%를 차지한다는 수치로 나왔고, 현장에서는 "여기서 막혔다"는 실감으로 나왔습니다. 양쪽이 같은 벽을 가리키고 있습니다.
본문 7절에서 정리한 "3~6개월은 봐야 한다"와 일치합니다.
아직 업계 표준이 없다는 점을 여러 번 강조하고, 자기가 해 보고 효과를 확인한 뒤에 알려주겠다는 태도를 반복합니다. 1인의 진행 중인 실험 기록으로 읽는 것이 맞습니다.
두 자료가 어디서 만나고 어디서 갈리는지 정리했습니다.
| 항목 | 본문 (웹 조사) | 현장 기록 | 판단 |
|---|---|---|---|
| GEO의 정의 | 콘텐츠가 인용되는 것 | 업장이 추천되는 것 | 목표가 다름. 사업체라면 현장 쪽 |
| 글 쓰는 법 | 질문형 제목·결론 먼저·수치·출처·FAQ | 동일한 10개 체크리스트 | 일치 — 독립적으로 같은 결론 |
| 외부 배포 | 상위 50개 도메인이 인용의 68% | DA 높은 곳 배포가 관건, 여기서 막힘 | 일치 — 같은 벽 |
| 소요 기간 | 3~6개월 | 6개월까지 보고 들어감 | 일치 |
| 주제 선택 | 동향·분석 78% vs 방법 안내 12% | 오리지널리티·뾰족한 컨셉 | 일치 |
llms.txt |
효과 확인 안 됨 (독립 조사 3곳 + 구글 안내) |
"스키마 마크업, llms 등등"이 필요하다고 언급 | 어긋남. 근거는 본문 쪽이 강함. 해도 손해는 없으나 믿고 기대지 말 것 |
| 측정 방법 | Search Console·직접 질문·크롤러 로그 | 같은 환경에서 반복 질문 → 추천 확률 % | 현장 쪽이 더 구체적. 가져다 쓸 만함 |
| 블로그 선택 | — | 네이버 말고 티스토리 | 국내 특수 맥락. 본문엔 없는 정보 |
| 리뷰 전략 | — | 주력 진료 위주로만 구글 리뷰 수집 | 로컬 비즈니스 전용. 본문에 없는 실전 팁 |
겹치는 항목이 많다는 게 오히려 중요합니다. 출처와 맥락이 전혀 다른 두 자료가 같은 결론에 닿았다면
그 항목은 먼저 해도 되는 것이고, 갈리는 항목(llms.txt)은 판단을 보류하면 됩니다.
이 문서는 2026년 9월 10일에 조사했습니다. 이 분야는 정책이 자주 바뀌므로 특히 Cloudflare 항목은 직접 확인하시기 바랍니다.
부록(현장 기록)은 사용자가 수집해 전달한 자료로, 한의원 원장(송원장)이 2026년 5~7월 네이버 블로그에 연재한 GEO 실전 후기를 요약·재구성한 것입니다. 본문의 웹 조사와는 출처·성격이 다릅니다. 언급된 진단 도구는 geo-check-xi.vercel.app이며 제가 검증하지는 않았습니다.
본문 출처
· Generative Engine Optimization (GEO): The 2026 Guide to AI Search Visibility — LLMrefs
· GEO Guide 2026: Generative Engine Optimization Explained — Digital Applied
· GEO Best Practices 2026 — SEO Tuners
· AI Crawlers Explained: GPTBot, ClaudeBot, PerplexityBot (2026) — Anagram
· AI Crawler Access Control: The 2026 Decision Matrix — Digital Applied
· The AI User-Agent Landscape in 2026 — No Hacks
· Cloudflare's new policy pushes AI companies to pay for publishers' content — TechCrunch
· Cloudflare Will Block AI Crawlers by Default on September 15 — Chudi.dev
· AI Crawl Control — Cloudflare 공식 문서
· Structured Data in 2026: The Schema Markup AI Actually Uses — GlobeRunner
· Schema Markup for AI Search: What Actually Works in 2026 — Loonis
· How AI Answer Engines Decide Which Sources to Cite — AuthorityTech
· The AI Citation Source Index 2026: Top 50 Websites — Everything PR
· Content Freshness in 2026 — AuthorityTech
· Hugo SEO Best Practices — CloudCannon
· Hugo SEO Optimization: Complete Guide 2026 — IndexeDev
· 네이버 서치어드바이저란? 등록 없이도 검색된다 (2026) — 서치폴라리스
· 네이버 서치어드바이저 웹사이트 등록 및 색인 방법 — 킨다그로스