/GEO 배우기/체크리스트
테크니컬 GEO · 총정리

기술 GEO 체크리스트, 실행해야 할 순서대로.

세 계층에 걸친 열 가지 점검입니다. 항목마다 무엇을 실행할지, 통과와 실패가 각각 어떤 모습인지, 실패했을 때 어느 글을 읽을지를 밝힙니다. 순서는 장식이 아닙니다. 항목들이 서로 독립적이지 않기 때문입니다.

이 페이지의 내용
이 글 공유하기
X에 공유 LinkedIn에 공유
짧은 답

기술 체크리스트는 세 계층에 걸친 열 가지 점검이며, 값싼 것부터 실행합니다. 평범한 페치 한 번으로 끝나는 것이 네 가지, 자사 서버 로그만 답할 수 있는 것이 세 가지, 수정이 아니라 결정인 것이 세 가지입니다. 순서 자체가 논증을 담고 있습니다. 항목들이 독립적이지 않아서, 위쪽에서 하나가 실패하면 그 아래의 모든 측정을 읽을 수 없게 되기 때문입니다. AI 답변이 이미 인용한 URL 가운데 27.1%는 아예 가져올 수 없었습니다. 접근이 불가능하거나, 삭제되었거나, 텍스트가 아니었기 때문입니다. 이것이 엔진들이 이미 골라 놓은 페이지에서 나온 1계층 실패율입니다.8

핵심 요약
  • 1계층은 중요한 URL마다 페치를 한 번 하는 것입니다. 상태 코드, 원본 응답 안의 본문, 검색 측 토큰별 robots 결과, 스니펫 지시문입니다. 이 네 가지가 통과하기 전에는 그 아래 어느 것도 믿을 수 없습니다.
  • 2계층이 존재하는 이유는, 1계층은 서버가 무엇을 하도록 설정되었는지를 시험하고 로그는 서버가 실제로 무엇을 했는지를 기록하기 때문입니다. 봇 관리 규칙은 robots.txt보다 우선하며, 스스로 알리지 않습니다.
  • 3계층은 수정이 아닙니다. 게이트, 사용자 요청형 페처, 최종 수정일의 정직함은 정책 판단이며, 뉴스 사이트에 맞는 답이 문서 사이트에는 틀린 답입니다.
  • 전부 통과하면 자격을 얻을 뿐, 인용을 얻지는 못합니다. robots.txt 변경이 반영되기까지 약 24시간이 걸린다고 두 업체가 문서에 적어 두었으니, 다음 날 다시 확인하십시오.
순서

왜 이 체크리스트의 순서가 곧 체크리스트인가?

체크리스트는 항목이 의존 관계 순으로 놓였을 때에만 값어치가 있고, 기술 항목은 유난히 서로 의존합니다. 아래 열 가지 중 네 가지는 명령줄 페치 한 번으로 끝납니다. 세 가지는 한 달치 보관된 서버 로그와 그것을 조회할 수 있는 사람이 필요합니다. 세 가지는 아예 수정이 아닙니다. 남의 기계가 무엇을 읽을 수 있게 하고 싶은지에 대한 결정입니다. 이 순서로 실행하는 것은 깔끔함 때문이 아니라, 결과가 의미를 갖는 유일한 순서이기 때문입니다.

의존은 한 방향으로만 흐릅니다. 평범한 페치가 페이지 대신 챌린지를 돌려준다면, 그 뒤에 살펴보는 모든 로그는 침묵을 보여 주지만 그 이유는 엔진이 여러분에게 관심이 있는지와 아무 상관이 없습니다. robots.txt가 검색 측 토큰을 막고 있으면 한 달치 크롤 데이터는 무관심처럼 읽히고, 팀은 AI 엔진이 자기 카테고리를 무시한다고 결론을 내리지만, 실제로는 사이트가 오지 말라고 말한 것입니다. 본문이 하이드레이션 이후에만 존재한다면, 인용 측정은 글이 아니라 JavaScript 번들을 측정합니다. 셋 다 진짜 음성과 똑같이 생긴 거짓 음성입니다. 그래서 목록 위쪽의 실패는 들고 갈 메모가 아니라 중단 지시입니다.

비용도 같은 방향을 가리킵니다. 1계층은 노트북과 10분입니다. 2계층은 한 사람의 하루를 쓰고, 여러분에게 없을 수도 있는 로그 보관이 필요합니다. 3계층은 회의 한 번입니다. 값싼 점검이 값비싼 점검의 관문이므로, 1계층 실패에 대한 대응은 고치고, 업체 시스템이 따라잡기를 기다리고, 맨 위에서 다시 시작하는 것입니다. 각 항목의 근거는 그 항목의 글에 있으며 항목에서 링크해 두었습니다. 이 페이지가 더하는 것은 순서와 실행 방법입니다.

1계층

평범한 페치 한 번으로 10분 안에 무엇을 정리할 수 있나?

네 가지 점검, 각각 명령 하나, 도구도 계정도 필요 없습니다. 홈페이지만이 아니라 인용되길 바라는 모든 URL에 대해 실행하십시오.

01

토큰별 상태 코드

각 URL을 검색 측 사용자 에이전트마다 페치합니다. curl -sIL -A OAI-SearchBot https://example.com/page. 통과는 200이고 리다이렉트는 최대 한 홉까지입니다. 실패는 403, 429, 503, 인터스티셜, 또는 리다이렉트 체인입니다. 실패하면 페이월과 차단을 읽으십시오.

02

원본 응답 안의 본문

원본 응답을 파일로 저장하고, 그 안에서 인용되길 바라는 문장을 찾습니다. 통과는 서버가 보낸 바이트 안에서 그 문장을 찾는 것입니다. 실패는 페이지를 브라우저에서 실행한 뒤에야 찾는 것입니다. 실패하면 JavaScript는 실행되나를 읽으십시오.

03

robots.txt 결과, 토큰별로

Googlebot, OAI-SearchBot,3 Claude-SearchBot,4 PerplexityBot5, Applebot6에 대해 실효 결과를 따로 평가한 뒤, 각각을 실제 페치로 확인합니다. 통과는 모든 검색 측 토큰이 허용된 상태이고, 실패는 대개 물려받은 와일드카드 금지입니다. 실패하면 크롤러 토큰을 읽으십시오.

04

색인되고 스니펫 표시 가능

Google이 밝힌 요건은 페이지가 “색인되어 있고 스니펫과 함께 Google 검색에 표시될 자격이 있어야 한다”는 것입니다.1 통과는 자기 참조적 canonical이 있고, head에도 헤더에도 noindex, nosnippet, max-snippet 지시문이 없는 상태입니다. 실패하면 크롤링 가능성과 색인 등록을 읽으십시오.

결과는 사이트 단위가 아니라 URL 단위로 기록합니다. 홈페이지는 거의 언제나 네 가지를 다 통과합니다. 1계층이 실패하는 곳은 실제 답을 담고 있는 깊은 페이지이고, 엔진에 필요한 것이 바로 그 페이지입니다. 네 가지 중 두 가지가 함께 실패하는 일도 흔합니다. 클라이언트 렌더링 애플리케이션은 봇 규칙이 붙은 엣지 설정 뒤에 놓이는 경향이 있기 때문입니다. 이것이 왜 나머지 작업 전체의 상한이 되는지는 검색 가능성 상한에서 논증합니다.

2계층

자사 로그만 답할 수 있는 것은 무엇인가?

1계층은 서버가 무엇을 해야 하는지를 시험합니다. 로그는 서버가 실제로 무엇을 했는지를 기록하며, 이 둘은 누구의 예상보다도 자주 어긋납니다.

05

토큰별, 날짜별 도착

30일치 접근 로그를 사용자 에이전트로 걸러, 검색 측 토큰마다 따로 셉니다. 통과는 허용한 모든 토큰에 대해 0이 아니고 대체로 안정적인 건수가 나오는 것입니다. 실패는 robots.txt가 허용한 토큰의 건수가 0인 경우로, 파일과 로그 사이의 무언가가 그것들을 떨어뜨리고 있습니다. 그러면 AI 크롤 트래픽을 읽으십시오.

06

낭비된 페치

토큰별로 404나 리다이렉트를 돌려받은 요청의 비중을 셉니다. 한 인프라 업체의 2024년 12월 로그 연구는 ChatGPT 크롤러 페치의 34.82%, Claude의 34.16%가 404에 도착했고 Googlebot은 8.22%였다고 보고했습니다.7 통과는 Googlebot 쪽에 더 가까이 있는 것이며, 차이가 나면 오래된 사이트맵이나 폐기된 URL을 가리킵니다.

07

조용한 챌린지

토큰별로 403, 429, 503 응답을 찾되, 웹 서버 로그만이 아니라 방화벽 자체의 이벤트 로그를 읽으십시오. Perplexity는 사이트 소유자가 웹 애플리케이션 방화벽에서 자사 봇을 명시적으로 허용 목록에 넣어야 할 수 있다고 문서에 적어 두었습니다.5 통과는 허용한 토큰에 대해 챌린지 이벤트가 하나도 없는 것입니다.

07번은 문서상 설정과 가장 자주 어긋나는 항목입니다. robots 지시문은 예의 바른 크롤러가 지키는 요청입니다. 봇 관리 규칙은 여러분의 애플리케이션이 무엇을 보기도 전에 작동하는 강제이고, 대개 다른 팀이 소유합니다. 둘이 어긋나면 강제가 이기고, robots 파일은 아무도 들여다볼 만한 증상 없이 몇 달 동안 틀린 채로 남습니다. 어떤 팀은 robots.txt 수정 전후를 비교했다가 크롤 양이 꿈쩍도 하지 않는 것을 보고, 원인을 방금 편집한 파일이 아니라 엣지의 관리형 봇 규칙 세트에서 찾았습니다. 그 데이터를 어떻게 읽는지, 그리고 진짜 크롤러와 그 이름만 뒤집어쓴 것을 어떻게 구분하는지는 크롤러 로그 읽기에서 다룹니다.

3계층

수정이 아니라 결정으로 남는 것은 무엇인가?

마지막 세 항목에는 체크리스트가 줄 수 있는 정답이 없습니다. 이 사이트가 무엇을 위한 것인지 말할 수 있는 사람이 필요합니다.

08

게이트, 의도인가 사고인가

어떤 콘텐츠를 로그인, 페이월, 동의 벽 뒤에 둘지 명시적으로 결정하고, 그 결정을 적어 두십시오. 통과는 누군가 고르고 누군가 책임지는 게이트입니다. 실패는 아무도 고르지 않은 게이트이며, 대개 태그 관리자에서 나온 동의 인터스티셜입니다. 이 맞바꿈은 페이월과 차단에서 논증합니다.

09

사용자 요청형 페처

ChatGPT-User, Claude-User, Perplexity-User는 크롤 일정이 아니라 사람이 물었기 때문에 페치하며, Perplexity는 “사용자가 페치를 요청했으므로 이 페처는 일반적으로 robots.txt 규칙을 무시합니다”라고 문서에 적어 두었습니다.5 통과는 이들을 어떻게 대할지 이미 결정해 둔 것입니다. 이들을 크롤러와 똑같이 대하는 것은 선택이지 기본값이 아닙니다.

10

사실인 최종 수정일

Last-Modified 헤더와 공개된 수정일을 실제 마지막 편집과 대조합니다. 통과는 둘이 일치하는 것입니다. 실패는 빌드가 모든 파일에 오늘 날짜를 찍는 경우이며, 이는 한 페이지가 아니라 도메인 전체에서 신선도를 무의미하게 만듭니다.

세 항목 모두 스크립트가 계산할 수 있는 통과 기준이 없고, 그래서 맨 아래에 있습니다. 바뀌는 빈도도 가장 낮습니다. 08번은 비즈니스 모델이 바뀔 때, 09번은 업체가 새 문서를 낼 때, 10번은 누군가 빌드를 고칠 때 한 번입니다. 그 위의 모든 것은 주기를 정할 만합니다. 그 항목들을 망가뜨리는 것은 아무도 둘 중 어느 쪽으로도 분류하지 않은 배포와 인프라 변경이기 때문입니다.

범위

일부러 목록에 넣지 않은 항목은?

목록에 있는 항목, 순서대로

  • 검색 측 토큰별 상태 코드
  • 원본 응답 안의 본문
  • 토큰별 robots.txt 결과
  • 색인됨, canonical 정상, 스니펫 허용
  • 자사 로그의 토큰별 도착
  • 토큰별 404와 리다이렉트 비중
  • 조용한 방화벽 챌린지 없음
  • 게이트가 의도적이고 책임자가 있음
  • 사용자 요청형 페처에 대한 방침
  • 사실인 최종 수정일

목록에 없는 항목과 그 이유

  • llms.txt: Google의 안내는 검색이 그런 파일을 사용하지 않는다고 말합니다
  • 리치 결과가 아니라 인용을 얻으려는 기대로 추가하는 schema
  • 학습용 토큰 차단. 이것이 바꾸는 것은 모델이 배우는 내용이지 답변이 인용하는 대상이 아닙니다
  • 와일드카드 전면 금지. 원하던 검색 크롤러까지 없애 버립니다
  • 표본을 밝히지 않고 크롤러 히트 수만으로 파는 전술

제외는 취향의 문제가 아닙니다. Google의 안내는 “Google 검색(생성형 AI 기능 포함)에 표시되기 위해 새로운 기계 판독 파일, AI 텍스트 파일, 마크업, Markdown을 만들 필요가 없습니다. Google 검색 자체가 그것들을 사용하지 않기 때문입니다”라고 밝힙니다.2 이 문장은 1차 출처이고 날짜가 있으며, 이는 그 문장이 배제하는 전술들이 내놓을 수 있는 것보다 낫습니다. 구조화된 데이터는 리치 결과를 위해서라면 여전히 내놓을 가치가 있고 그쪽 근거는 오래되었지만 좋습니다. 뒷받침이 전혀 없는 것은 거기에 붙여 놓은 인용 주장 쪽입니다. 그럴듯해 보이는 항목을 모두 담은 목록은 스스로의 목적도 무너뜨립니다. 열 가지는 실행되고, 스물다섯 가지는 훑어보게 되며, 정작 중요했던 네 가지는 훑어본 부분에 들어 있습니다.

주기

얼마나 자주 다시 실행해야 하나?

라우팅, 렌더링, 응답 헤더, 엣지 설정을 건드리는 배포가 있을 때마다 1계층을 다시 실행합니다. 대부분의 팀에서 이는 분기마다가 아니라 매주를 뜻합니다. 2계층은 매달 다시 실행합니다. 그 신호는 추세이고 하루치 로그는 노이즈이기 때문입니다. 3계층은 코드가 바뀔 때가 아니라 비즈니스가 바뀔 때 움직입니다.

재확인을 믿기 전에 하루를 기다리십시오. OpenAI 문서는 “사이트의 robots.txt 업데이트가 저희 시스템에 반영되기까지 약 24시간이 걸릴 수 있습니다”라고 밝히고,3 Perplexity 문서는 변경 반영에 “최대 24시간이 걸릴 수 있습니다”라고 밝힙니다.5 고친 지 한 시간 만에 다시 시험해 예전 동작을 보는 것은, 팀이 옳은 변경을 스스로 되돌리게 되는 가장 흔한 경로입니다.

결과는 오래 남는 곳에, 실행마다 URL마다 한 행씩, 날짜를 붙여 보관하십시오. 두 번째 실행의 가치는 첫 번째와의 차이에 있고, 터미널 기록에만 사는 체크리스트는 차이를 만들지 못합니다. 통과와 실패 말고도 계속 들고 갈 만한 열이 둘 있습니다. 어떤 항목이 실패했는지, 그리고 두 실행 사이에 무엇을 배포했는지입니다. 이 짝이 이 작업이 만들어 낼 수 있는 유일한 인과 근거입니다. 약한 근거이지만, 실제로 모을 수 있는 종류의 근거입니다.

이 체크리스트의 정직한 한계

열 가지 항목의 목록은 그 열 가지가 전부이고 전부 통과가 곧 성과인 것처럼 보이게 합니다. 둘 다 사실이 아닙니다. 이 목록이 빠짐없이 담은 것은 사이트 바깥과 자사 로그에서 값싸게 검출할 수 있는 실패뿐입니다. 페이지는 열 항목을 모두 통과하고도 엔진이 던진 쿼리 중 어느 것과도 맞지 않을 수 있고, 그것은 이 페이지가 볼 수 없는 커버리지 문제입니다. 통과가 세우는 것은 자격이지 인용이 아니며, 그 둘 사이에는 그 뒤에 내려지는 모든 순위, 선택, 종합 결정이 놓여 있습니다. 2026년 비판적 서베이는 인용 점수가 클릭, 전환, 매출을 예측한다는 주장을 매우 낮은 확신도로 평가합니다.9 다 끝낸 체크리스트는 장애물 하나를 치운 것으로 읽고, 결코 성과로 읽지 마십시오. 1계층은 1차 업체 문서에 기대고 있어 튼튼하지만, 그중 어느 것이든 돈과 연결하는 근거는 아직 없습니다.

제품이 쓸모 있는 곳과 그렇지 않은 곳

위의 모든 항목은 무료입니다. 1계층에는 curl과 10분이, 2계층에는 이미 가지고 있는 로그 접근 권한이, 3계층에는 어떤 소프트웨어도 대신해 줄 수 없는 결정이 필요합니다. Bavior는 그 어느 것도 하지 않습니다. 여러분의 사이트를 크롤링하지 않고, robots.txt를 읽지 않으며, 차단된 페이지를 가져올 수 있게 만들지도 못합니다. Bavior가 맡는 것은 이 목록 다음에 오는 일입니다. 고정된 프롬프트 묶음을 여러 엔진에 일정에 따라 실행하고, 각 답변이 어떤 출처를 인용했는지 기록합니다. 1계층 수리가 누가 인용되는지를 바꾸었는지는 그렇게 알게 됩니다. 체크리스트를 먼저 실행하십시오. 리트리벌되지 않는 페이지를 재는 것은 아무것도 재지 않는 것입니다. 답변에서 얼마나 많은 몫을 가질 수 있는지는 답변에서 내 몫에서 다룹니다.

출처, 모두 2026년 8월 30일 확인
  1. Google Search Central, “AI features and your website”, 2025년 12월 10일 최종 업데이트(색인되고 스니펫 표시가 가능해야 한다는 요건, 1차 출처): developers.google.com/search/docs/appearance/ai-features
  2. Google Search Central, “Google’s Guide to Optimizing for Generative AI Features on Google Search”, 2026년 7월 10일(새로운 AI 텍스트 파일은 필요 없음, 1차 출처): developers.google.com/search/docs/fundamentals/ai-optimization-guide
  3. OpenAI, 크롤러 및 봇 문서(OAI-SearchBot, GPTBot, ChatGPT-User, robots.txt 변경 반영에 약 24시간, 1차 출처): developers.openai.com/api/docs/bots
  4. Anthropic, “Does Anthropic crawl data from the web?”(ClaudeBot, Claude-SearchBot, 1차 출처): support.claude.com/en/articles/8896518
  5. Perplexity, 봇 문서(PerplexityBot, Perplexity-User, 사용자 요청형 페치, 방화벽 허용 목록, 1차 출처): docs.perplexity.ai/guides/bots
  6. Apple, “About Applebot”(Applebot, Applebot-Extended, 1차 출처): support.apple.com/en-us/119829
  7. Zecchini, Moore, Ubl, Siddle, “The rise of the AI crawler”, Vercel, 2024년 12월 17일, 크롤러별 404와 리다이렉트 비중(1차 로그 데이터): vercel.com/blog/the-rise-of-the-ai-crawler
  8. Allaham & Diakopoulos, 2026, 인용된 URL의 27.1%는 접근 불가, 삭제, 또는 텍스트가 아니어서 스크래핑할 수 없었음(프리프린트, 주 9의 서베이에서 보고)
  9. “Optimizing Visibility in Generative Engines: A Critical Survey of Generative Engine Optimization (2023 to 2026)”, arXiv:2607.14035, 표 5는 인용 점수가 클릭이나 매출을 예측한다는 것을 매우 낮은 확신도로 평가: arxiv.org/abs/2607.14035
FAQ

자주 묻는 질문입니다.

이 목록에서 가장 흔한 실패는 무엇입니까?

03번, 구체적으로는 지금 팀에 있는 누구보다도 오래된, robots.txt에 물려받은 와일드카드 금지입니다. 검색 측 크롤러를 한 번에 모두 없애고, 진짜 무관심이 만드는 것과 똑같은 로그 흔적을 남기며, 파일을 위에서 아래로 읽지 않고 토큰별로 평가하지 않는 한 보이지 않은 채로 남습니다. 로그에 하루를 쓰기 전에 이것부터 확인하십시오.

1계층이 통과하면 로그 작업은 건너뛰어도 됩니까?

아니요. 1계층은 의도를 시험하고 로그는 강제를 시험하기 때문입니다. 엣지의 봇 관리 규칙은 여러분의 애플리케이션이나 robots.txt가 조회되기도 전에 요청을 막고, 대개 다른 팀이 소유합니다. Perplexity 자체 문서는 웹 애플리케이션 방화벽에서 자사 봇을 명시적으로 허용 목록에 넣어야 할 수 있다고 사이트 소유자에게 경고합니다. 1계층은 그 어느 것도 볼 수 없습니다.

고친 뒤 무언가 바뀌기까지 얼마나 걸립니까?

동작은 하루보다 오래, 성과는 그보다 더 오래 걸립니다. OpenAI는 robots.txt 변경 반영에 약 24시간, Perplexity는 최대 24시간이 걸린다고 문서에 적어 두었으므로, 같은 날 오후에 다시 시험하면 예전 상태를 읽게 되어 실패처럼 보입니다. 다음으로 움직이는 것은 크롤 양이고 몇 주가 걸립니다. 인용이 뒤따르는지는 별개의 문제이며 이 목록은 답하지 않습니다.

모든 항목을 통과하면 인용됩니까?

아니요. 체크리스트가 세우는 것은 자격, 즉 후보가 될 수 있는지 여부이고 그 이상은 아닙니다. 선택, 순위, 종합은 모두 그 뒤에 일어나며, 페이지는 열 항목을 모두 통과하고도 엔진이 실제로 던진 쿼리 중 어느 것과도 맞지 않을 수 있습니다. 전부 통과는 장애물 하나를 치운 것으로 읽고, 그다음에 커버리지와 콘텐츠 작업을 하러 가십시오.

Bavior 편집팀

Reddit 마케팅과 AI 검색 가시성에 관한 Bavior의 콘텐츠를 조사하고 관리하는 팀입니다. 본문의 모든 수치에는 출처와 확인 날짜를 명시했으며, 제휴 링크는 사용하지 않습니다.

수치에 오류를 발견하셨나요? 알려주시면 다시 확인하겠습니다: support@bavior.com

자격은 바닥이지 결승선이 아닙니다.
통과한 뒤 누가 인용되는지 보십시오.

무료 체험 시작