한줄 요약: GEO 컨설팅은 생성형 AI 답변에 브랜드가 인용되도록 콘텐츠 구조, 크롤러 접근 정책, 측정 체계를 함께 설계하는 자문 서비스입니다. 제안서를 볼 때는 구글이 공식 문서에서 불필요하다고 밝힌 항목이 핵심 딜리버러블로 들어있는지, 검증 불가능한 인용 순위를 보장하는지, 예산을 어떤 페이지에 배분하는지 세 가지를 보면 됩니다.
GEO 컨설팅은 생성형 AI 답변 엔진이 브랜드를 인용하도록 콘텐츠 구조와 크롤러 접근 정책, 성과 측정 체계를 함께 설계하는 자문 서비스입니다. 콘텐츠를 대신 써주는 외주와 다르고, 순위를 올려주는 기존 SEO 대행과도 범위가 다릅니다.
계약 전에 세 가지만 확인하면 대부분의 부실 제안서가 걸러집니다. 구글이 공식 문서에서 필요 없다고 적어둔 항목이 핵심 산출물로 들어있는가, 특정 AI에서의 인용 순위를 보장한다고 쓰여 있는가, 예산을 이미 잘 나오는 페이지에 쓰겠다고 하는가. 셋 중 하나라도 해당되면 견적의 근거를 다시 물어야 합니다.
서치폴라리스 팀이 국내외 GEO 제안서를 검토하면서 반복해서 걸러낸 패턴을 공개 문서와 연구 데이터에 붙여 정리했습니다.
이 글에서 다루는 내용: - AI 답변이 클릭을 얼마나 가져갔는지 보여주는 측정 데이터 - 구글이 직접 불필요하다고 명시한 GEO 딜리버러블 - 인용 순위 보장 계약이 검증될 수 없는 통계적 이유 - GEO 예산을 어떤 페이지에 배분해야 하는가 - 한국 시장에서의 최소 스코프와 비용 협상 기준
컨설팅 도입 시점은 트래픽이 아니라 답변에서 갈린다
지금 GEO 자문을 검토할 이유는 검색 결과에서 클릭이 사라지는 속도에 있습니다. 순위는 그대로인데 유입만 줄어드는 구간이 먼저 옵니다.
퓨리서치센터(Pew Research Center)가 미국 성인 900명의 브라우징 로그를 분석한 결과, 구글 검색에 AI 요약이 표시됐을 때 일반 검색 결과를 클릭한 비율은 8%였습니다. AI 요약이 없을 때는 15%였어요. 요약 안에 달린 출처 링크를 클릭한 경우는 1%에 그쳤습니다. 2025년 3월 검색 68,879건을 대상으로 한 퓨리서치센터 분석입니다.
국내 수요도 같은 방향으로 움직였습니다. 과학기술정보통신부가 2026년 3월 발표한 2025 인터넷이용실태조사에서 생성형 AI 이용 경험률은 44.5%로, 전년 33.3%에서 11.2%포인트 올랐습니다.
여기서 컨설팅 구매 판단이 갈립니다.
자체 인력으로 콘텐츠 구조만 바꾸면 되는 회사가 있고, 크롤러 정책부터 측정 설계까지 한 번에 정리해야 하는 회사가 있어요. 후자는 대개 도메인이 크고 레거시 페이지가 많으며 담당 팀이 여러 개로 쪼개진 조직입니다. 결정 권한이 흩어져 있으면 외부 자문의 값어치가 실행 대행보다 큽니다. 업체 선정 기준을 먼저 정리하고 싶다면 GEO 에이전시 선택 기준 가이드를 함께 보면 됩니다.
구글이 문서에 직접 "필요 없다"고 적어둔 것들
제안서를 가장 빠르게 검증하는 방법은 구글 공식 문서와 대조하는 겁니다. 구글은 자사 AI 기능에 노출되기 위한 별도 최적화가 없다고 문서에 명시했어요.
구글 서치 센트럴의 AI 기능과 웹사이트 문서는 AI Overviews나 AI Mode에 나오기 위한 추가 요건이나 특별한 최적화가 없다고 적었습니다. 새로운 기계 판독용 파일이나 AI 텍스트 파일, 전용 마크업을 만들 필요가 없다는 문장도 함께 들어 있어요. 2026년 7월 갱신된 생성형 AI 최적화 가이드에서도 같은 입장이 유지됐습니다.
llms.txt 파일의 실제 사용 데이터도 이 방향과 어긋나지 않습니다. Originality.ai와 Ahrefs 집계를 인용한 PPC Land 보도에 따르면 2026년 5월 기준 llms.txt를 둔 사이트는 36,120개로 1년 새 8.8배 늘었지만, 같은 달 이 파일의 97%는 요청을 한 번도 받지 못했습니다.
그러니 견적서에서 이런 항목이 핵심 산출물 자리에 있으면 근거를 물어야 합니다.
| 제안서 항목 | 구글 공식 입장 | 구매자 대응 |
|---|---|---|
| AI 전용 텍스트 파일 생성 | 구글 검색 노출에 필요하지 않음 | 부가 항목으로 내리고 비용 재산정 |
| AI 전용 스키마 마크업 추가 | 전용 schema.org 마크업은 없음 | 리치 결과용 구조화 데이터와 구분해 확인 |
| AI용 콘텐츠 재작성 일괄 적용 | 특별한 최적화 요건 없음 | 페이지 단위 근거와 측정 계획 요구 |
| 대량 페이지 자동 생성 | 대규모 콘텐츠 남용 정책 대상 | 스팸 정책 위반 리스크로 반려 |
마지막 줄은 특히 조심할 항목입니다. 구글은 2024년 3월 스팸 정책 개편에서 대규모 콘텐츠 남용을 신설하면서, 자동화든 사람이 쓴 것이든 생성 방식과 무관하게 순위 조작 목적의 대량 저품질 콘텐츠를 제재 대상으로 규정했습니다.
구조화 데이터 자체가 쓸모없다는 뜻은 아니에요. AI 전용 스키마가 따로 없다는 것과 스키마가 무의미하다는 것은 다른 이야기입니다. 이 구분은 구조화 데이터로 AI 인용률 높이는 법에서 자세히 다뤘어요.
인용 순위를 보장하는 계약서는 검증될 수 없다
"챗GPT 추천 1위 보장" 같은 문구를 계약서에 넣자는 제안이 종종 옵니다.
그런 조항은 검증이 안 됩니다.
스파크토로(SparkToro)가 2026년 1월 공개한 연구는 자원자 600명을 통해 12개 프롬프트를 총 2,961회 실행했습니다. 같은 프롬프트를 100회 물었을 때 브랜드 추천 목록이 동일하게 나올 확률은 1% 미만이었고, 순서까지 같을 확률은 1,000분의 1 수준이었어요. 같은 질문을 던져도 매번 다른 눈금이 나오는 주사위를 계약 지표로 삼는 셈입니다.
다만 이 연구는 반대편 사실도 같이 보여줍니다. 개별 응답은 흔들려도 집계 수준에서는 꽤 안정적이었어요. 특정 의료기관은 챗GPT 응답 71건 중 69건에 등장했고, 헤드폰 브랜드들은 994개 응답에서 55%에서 77% 사이의 등장률을 유지했습니다.
계약서에 쓸 지표는 여기서 나옵니다. 단일 질문의 순위가 아니라 반복 실행 기준 등장률이에요. 프롬프트 세트를 30개에서 50개로 고정하고, 실행 횟수와 측정 주기를 명시하고, 등장률과 언급 점유율을 지표로 잡으면 양측이 같은 숫자를 봅니다.
우리는 특정 프롬프트 1위 보장을 KPI로 제시하는 업체는 추천하지 않아요. 지킬 수 있어서가 아니라 지켰는지 확인할 방법이 없기 때문입니다.
예산은 1위 페이지가 아니라 밀려 있는 자산으로 간다
GEO 예산을 어디에 쓸지가 컨설팅 품질을 가장 크게 가릅니다. 여기서 직관과 데이터가 갈려요.
GEO라는 개념을 처음 정식화한 KDD 2024 논문 GEO: Generative Engine Optimization은 콘텐츠 가시성을 최대 40%까지 높일 수 있다고 보고했습니다. 인용구 추가와 통계 추가, 출처 표기가 상위 기법이었고, 전통 SEO식 키워드 스터핑은 유일하게 가시성을 떨어뜨렸어요.
흥미로운 건 순위별 효과입니다. 같은 논문에서 출처 표기 기법을 적용했을 때 검색 5위권 사이트는 가시성이 115.1% 올랐지만, 1위 사이트는 30.3% 떨어졌습니다. 인용구 추가와 통계 추가에서도 방향이 같았어요.
이미 1등인 페이지를 GEO로 다시 손보는 건 수익이 낮은 작업이라는 뜻입니다.
같은 결론이 실제 검색 데이터에서도 나옵니다. Ahrefs가 2026년 3월 공개한 분석에서 구글 AI Overviews에 인용된 페이지 중 해당 질의 상위 10위 안에 드는 비율은 38%였고, 11위에서 100위 사이가 31.2%, 100위 밖이 31.0%였습니다. 인용의 상당수가 검색 1페이지 밖에서 옵니다. 다만 Ahrefs는 자사 인용 탐지 방식이 바뀌어 과거 조사와 직접 비교하기 어렵다고 밝혔으니, 추세보다 분포로만 읽는 편이 안전해요.
그래서 제안서에 넣어야 할 문장은 이겁니다. 대상 페이지를 순위 구간별로 나누고, 11위에서 100위 사이의 기존 자산을 1순위 작업 대상으로 잡을 것.
아직 확실하지 않은 부분도 있어요. 2026년 7월 공개된 GEO 비판적 서베이는 원 논문의 개선폭이 해당 소스가 이미 답변 컨텍스트에 포함된 조건에서만 유효하며, 자연 발견가능성이나 지속적 트래픽 효과를 입증하지는 않는다고 지적했습니다. ~~그러니까 40%라는 숫자만 크게 박은 제안서는 논문을 안 읽은 겁니다.~~ 회수되는 단계와 인용되는 단계를 나눠서 계획을 요구하면 이 한계가 드러납니다.
한국에서는 최소 세 축을 봐야 한다
영어권 GEO 자료를 그대로 번역한 제안서는 국내 검색 접점을 통째로 놓칩니다. 한국은 축이 하나 더 있어요.

오픈서베이가 2026년 7월 발표한 AI 검색 트렌드 리포트에서 제미나이 만족도는 77.3%로 챗GPT 70.6%를 앞질렀습니다. 최근 3개월 이용 경험률은 챗GPT 58.1%, 제미나이 52.2%였어요. 전국 만 10세에서 59세 1,000명 대상 패널 조사이고 국가 통계는 아닙니다. 그래도 방향은 분명해요. 챗GPT 하나만 최적화 대상으로 잡은 스코프는 이미 좁습니다.
네이버 축은 더 직접적입니다. 네이버는 2026년 2월 실적 컨퍼런스콜에서 AI 브리핑이 통합검색 쿼리의 약 20%에 적용됐고 연말까지 적용 범위를 두 배로 넓히겠다고 밝혔습니다. 국내 검색 다섯 건 중 한 건이 이미 AI 답변을 거친다는 뜻이에요.
제안서에 네이버 항목이 없으면 스코프 누락으로 보면 됩니다. 서치폴라리스가 국내 프로젝트를 설계할 때 글로벌 엔진과 네이버를 분리해 잡는 이유이기도 해요. 두 쪽이 출처를 고르는 방식이 달라서 같은 문서로 두 곳을 동시에 만족시키기 어렵습니다.
비용을 협상할 중립 기준은 아직 SEO 시장뿐이다
GEO 컨설팅 비용을 검색하면 대부분 대행사 자기 가격표가 나옵니다. 서로 검증할 수 없는 숫자들이에요.
솔직히 말하면 GEO 전용 중립 가격 조사는 아직 존재하지 않습니다. 국내는 물론이고 해외에도 Clutch나 Credo 수준의 독립 조사가 GEO 항목으로 나온 걸 찾지 못했어요. 그래서 협상 기준으로 쓸 수 있는 건 SEO 시장 데이터가 유일합니다.
Ahrefs가 SEO 서비스 제공자 439명을 조사한 가격 조사에서 월 리테이너 평균은 2,917달러였고 에이전시 평균은 3,209달러였습니다. 응답자의 78.2%가 월 리테이너 방식으로 계약했어요. 미국 달러 기준이고 한국 시장가와 직접 비교할 수는 없습니다.
이 숫자의 쓸모는 절대 금액이 아니라 질문을 만드는 데 있습니다.
견적이 이 앵커의 몇 배인지 계산하고, 그 차액이 무엇을 사는지 항목으로 받아보세요. 프롬프트 모니터링 도구 라이선스인지, 크롤러 정책 감사인지, 콘텐츠 리라이팅 물량인지에 따라 값이 완전히 달라집니다. 계약 기간은 3개월보다 길게 잡는 편이 현실적이에요. 구글 공식 문서도 크롤링에 며칠에서 몇 주가 걸릴 수 있고 재크롤 요청을 반복해도 빨라지지 않는다고 적고 있습니다. 서비스 유형별 비교는 GEO와 SEO 에이전시 비교에서 정리했어요.
지금 측정되는 것과 아직 안 되는 것
성과 측정 항목은 계약서에서 가장 자주 뭉개지는 부분입니다. 2026년 7월 기준으로 공식 도구가 주는 데이터는 생각보다 좁아요.

구글은 2026년 6월 서치 콘솔에 생성형 AI 성과 리포트를 도입했습니다. 노출수와 페이지, 국가, 기기 데이터를 주지만 클릭은 포함되지 않고 초기 롤아웃도 영국 일부 사이트로 제한됐어요.
마이크로소프트 쪽이 오히려 인용 데이터에 가깝습니다. 빙 웹마스터 툴은 2026년 2월 AI 퍼포먼스 리포트를 공개 프리뷰로 내놨고, 코파일럿과 빙 AI 요약에서의 총 인용 횟수와 인용된 URL을 보여줍니다. 여기도 클릭 데이터는 없어요.
유입 쪽에는 다른 구멍이 있습니다. GA4는 2026년 5월부터 AI 어시스턴트를 기본 채널 그룹으로 분류하기 시작했지만, 클라우드플레어(Cloudflare)가 2025년 7월 밝힌 것처럼 클로드 네이티브 앱이 보내는 트래픽은 리퍼러 헤더를 포함하지 않습니다. 앱에서 온 방문은 출처가 비어 있어요.
정리하면 인용은 보이는데 클릭이 안 보이고, 클릭은 들어오는데 출처가 안 보이는 상태입니다. 이 상황에서 전환 귀속을 KPI로 잡으면 6개월 뒤 양측이 서로 다른 숫자를 들고 앉게 돼요. 우리는 계약 첫 6개월 지표를 인용 등장률과 인용 점유율로 잡고, 전환 귀속은 참고 지표로 내리는 구성을 선택합니다.
이런 경우엔 GEO 컨설팅을 권하지 않습니다.
월 발행량이 두세 건이고 도메인에 페이지가 수십 개뿐인 회사라면 외부 자문보다 내부 정리가 먼저입니다. 크롤러 허용 확인과 핵심 페이지 첫 문단 구조 정리는 하루면 끝나는 작업이고, 이걸 컨설팅 리테이너로 사는 건 비쌉니다. 로컬 오프라인 매장 중심이거나 전환의 대부분이 지역 검색과 지도에서 나오는 사업도 우선순위가 다릅니다.
GEO 컨설팅의 값은 새로운 기법 목록에서 나오지 않습니다. 검증 가능한 것과 불가능한 것의 경계를 정확히 그어주는 데서 나와요.
지금 시장에는 그 경계를 흐리는 제안서가 더 많습니다. 구글이 필요 없다고 적어둔 산출물이 상단에 있고, 검증 불가능한 순위 보장이 KPI로 잡혀 있고, 예산은 이미 잘 나오는 페이지로 갑니다. 세 가지를 확인하는 데 15분이면 충분해요.
다음 질문은 자연스럽게 이어집니다. 우리 도메인에서 11위에서 100위 사이에 잠긴 페이지는 몇 개인가, 그중 AI 답변이 자주 뜨는 질의와 겹치는 건 어느 것인가, 그 목록을 업체가 먼저 가져오는가. 서치폴라리스도 제안서를 낼 때 이 목록부터 만들고 시작합니다. 제안 요청서에 이 세 줄을 넣으면 업체 수준이 빠르게 갈립니다.
자주 묻는 질문
GEO 컨설팅과 SEO 대행의 차이는 무엇인가요?
SEO 대행은 검색 결과 순위를 목표로 콘텐츠와 기술 요소를 실행하는 서비스입니다. GEO 컨설팅은 생성형 AI 답변에 인용되는 것을 목표로 콘텐츠 구조와 크롤러 접근 정책, 측정 체계를 설계합니다. 실행 대행보다 의사결정 자문의 비중이 크고, 성과 지표도 순위가 아니라 인용 등장률과 언급 점유율로 잡습니다. 두 서비스는 대체 관계가 아니라 대상 지표가 다릅니다.
GEO 컨설팅 비용은 어느 정도가 적정한가요?
GEO 전용 중립 가격 조사는 아직 공개된 것이 없습니다. 참고할 수 있는 유일한 중립 앵커는 SEO 시장 데이터로, Ahrefs가 서비스 제공자 439명을 조사한 결과 월 리테이너 평균은 2,917달러, 에이전시 평균은 3,209달러였습니다. 견적을 볼 때는 절대 금액보다 이 앵커 대비 배수와 그 차액이 어떤 산출물을 사는지를 항목으로 확인하는 편이 정확합니다.
AI 검색에서 특정 순위를 보장한다는 업체는 믿을 수 있나요?
권하지 않습니다. 스파크토로가 2,961회 실행으로 측정한 결과 같은 프롬프트를 100회 물었을 때 브랜드 추천 목록이 동일할 확률은 1% 미만이었습니다. 단일 질문의 순위는 재현되지 않으므로 보장 여부를 검증할 방법이 없습니다. 대신 프롬프트 세트와 실행 횟수를 고정한 뒤 등장률과 언급 점유율을 계약 지표로 잡는 방식이 검증 가능합니다.
llms.txt나 AI 전용 스키마를 꼭 넣어야 하나요?
구글 서치 센트럴 문서는 AI Overviews나 AI Mode에 나오기 위한 추가 요건이 없으며 새 기계 판독용 파일이나 전용 schema.org 마크업을 만들 필요가 없다고 명시하고 있습니다. Originality.ai와 Ahrefs 집계 기준으로 2026년 5월 llms.txt 파일의 97%는 요청을 한 번도 받지 못했습니다. 다만 리치 결과용 구조화 데이터는 별개 사안이므로 함께 없애면 안 됩니다.
한국 기업이라면 어떤 AI 채널까지 범위에 넣어야 하나요?
최소한 챗GPT와 제미나이, 네이버 AI 브리핑 세 축입니다. 오픈서베이 2026년 7월 조사에서 제미나이 만족도는 77.3%로 챗GPT 70.6%를 앞섰고, 네이버는 2026년 2월 실적발표에서 AI 브리핑이 통합검색 쿼리의 약 20%에 적용됐으며 연말까지 두 배로 넓히겠다고 밝혔습니다. 챗GPT 단독 스코프는 국내 검색 접점의 상당 부분을 놓칩니다.
GEO 성과는 언제부터 확인할 수 있나요?
구글 공식 문서는 크롤링에 며칠에서 몇 주가 걸릴 수 있고 재크롤을 반복 요청해도 더 빨라지지 않는다고 안내합니다. 따라서 구조 변경의 반영 자체가 몇 주 단위이고, 인용 등장률이 안정적인 추세로 읽히려면 그보다 긴 관찰 기간이 필요합니다. 계약 기간을 3개월 미만으로 잡으면 측정 구간이 부족합니다.