전문가 컬럼

생성형 검색(GEO) 측정 지표 설계: 순위 대신 무엇을 세어야 하나

AI 답변에는 "몇 위"가 없다. 같은 질문에도 답이 매번 달라진다. 그래서 GEO 성과는 인용률·출처 인용률·인용 순서·동반 언급 브랜드·사실 정확도 다섯 가지로 세어야 한다. 각 지표의 정의와 계산, 질문 세트·엔진·주기를 정하는 설계 순서, 흔한 오류.

어딧지 편집팀검색·AI 노출 리서치2026-09-15약 8분 · 2300자
GEO측정KPI

왜 순위 하나로는 안 되는가

검색엔진 최적화의 성과는 "키워드 A 에서 N 위"로 요약된다. GEO 에는 이 숫자가 없다. 생성형 검색은 한 문단짜리 답을 쓰고 출처를 몇 개 붙일 뿐이며, 같은 질문을 다시 넣으면 답과 출처가 달라진다. 순위 대신 "여러 번 물었을 때 얼마나 자주, 어떤 위치로, 누구와 함께 나오는가"를 세어야 한다.

즉 GEO 지표는 단일 값이 아니라 비율이고, 한 번의 측정이 아니라 반복 측정의 결과다. 이 두 가지를 전제로 지표를 정의한다.

지표 다섯 가지

지표정의계산주의
① 언급률답변 본문에 우리 브랜드가 등장한 비율언급된 (질문×엔진×회차) 수 ÷ 전체 시도 수이름 표기 변형(약칭·영문)을 같은 것으로 세어야 함
② 출처 인용률출처 링크에 우리 도메인이 붙은 비율인용된 시도 수 ÷ 전체 시도 수언급은 됐는데 인용은 안 된 경우를 따로 봄 — 인용 가능한 문장 부족의 신호
③ 인용 순서인용됐을 때 출처 목록에서 몇 번째였는가인용된 시도의 순서 평균 또는 중앙값엔진마다 출처 표시 방식이 달라 엔진별로 따로 봄
④ 동반 언급 브랜드같은 답에 함께 나온 브랜드 목록과 빈도브랜드별 등장 횟수 ÷ 전체 시도 수우리가 없는 답에서 누가 나오는지가 더 중요
⑤ 사실 정확도우리에 대해 AI 가 말한 내용이 맞는가언급된 답 중 오류가 있는 답의 비율가격·주소·서비스 범위 오류는 원본 페이지의 문장 문제인 경우가 많음

측정 설계: 질문 세트·엔진·주기·반복

  • 질문 세트 — 고객이 실제로 물을 법한 문장 20~30개. 유형을 섞는다: 정의("○○ 란"), 가격("○○ 비용"), 비교("○○ 와 △△"), 추천("○○ 업체 추천"), 지역("○○ 근처 ○○"). 키워드 목록을 그대로 쓰지 않는다.
  • 엔진 — 고객이 쓰는 곳을 고른다. 국내는 네이버 AI 브리핑과 구글 AI 오버뷰, ChatGPT, Perplexity 를 기본으로 두고 엔진별로 따로 집계한다. 합산 평균은 엔진 간 차이를 가린다.
  • 반복 — 같은 질문을 같은 엔진에 여러 회 넣는다. 1회 결과는 표본이 아니라 사례다. 회차 수는 비용과 기간에 맞춰 정하되, 정했으면 매 주기 같은 수를 유지한다.
  • 주기 — 4~8주. 페이지 수정·크롤러 허용처럼 즉시 반영되는 변화도 있지만, 언급을 늘리는 일은 수개월이 걸린다. 주기를 짧게 잡으면 변동을 성과로 오해한다.
  • 기록 형식 — 질문·엔진·회차·언급 여부·인용 여부·인용 순서·동반 브랜드·오류 메모를 한 행으로. 이 원본이 있어야 나중에 지표 정의를 바꿔도 다시 계산할 수 있다.

보고서에 쓰는 형식

가상의 "우리 회사" 예다. 값은 자리 표시이며, 실제 보고서는 엔진별로 한 표씩 둔다.

질문 유형언급률출처 인용률인용 순서(중앙값)우리 없는 답의 최다 브랜드
정의a/nb/nk(가상) ○○
가격a/nb/nk(가상) △△
비교a/nb/nk(가상) ○○
추천a/nb/nk(가상) □□
지역a/nb/nk—

이 표에서 할 일이 바로 읽힌다. 언급은 되는데 인용이 안 되는 유형은 해당 페이지의 문장을 고칠 차례이고(인용 가능한 문장), 우리가 없는 답에서 같은 브랜드가 반복되는 유형은 그 질문에 답하는 페이지 자체가 없는지부터 본다.

흔한 오류

  • 한 번 확인하고 "나온다/안 나온다"로 결론 내리기. 답은 매번 달라진다.
  • 엔진을 합쳐 평균 내기. 네이버에서 인용되고 ChatGPT 에서 빠지는 상태와 그 반대는 할 일이 다르다.
  • 브랜드명 완전 일치로만 세기. 약칭·영문·띄어쓰기 변형을 놓치면 언급률이 실제보다 낮게 나온다.
  • 크롤러 접근을 확인하지 않고 측정 시작하기. robots.txt 에서 AI 봇을 막아 두면 어떤 지표도 오르지 않는다(AI 크롤러).
  • 지표만 보고 원인을 안 보기. 사실 정확도가 낮으면 AI 탓이 아니라 우리 페이지에 오래된 가격·주소가 남아 있는 경우가 대부분이다.

어딧지에서는 어떻게 재나

어딧지 점검은 업종별 질문 세트를 AI 검색 여러 곳에 실제로 넣어 언급·인용 여부와 동반 브랜드를 위 형식으로 기록하고, 주기적으로 재측정해 변화를 보여 준다. 수작업으로 반복하기 어려운 부분을 대신하는 용도이며, 질문 세트는 우리 회사 상황에 맞게 바꿀 수 있다.

자주 묻는 질문

GEO 지표의 목표치는 얼마로 잡아야 하나요?

업종·질문 유형·엔진마다 다르고 외부에 비교 기준이 없습니다. 첫 측정을 기준선으로 두고 주기마다 같은 방식으로 재측정해 변화 방향을 보는 것이 현실적입니다. 지어낸 업계 평균과 비교하지 않습니다.

언급은 되는데 출처로 인용되지 않는 건 왜인가요?

AI 가 다른 출처의 문장에서 우리 이름을 알게 됐지만, 우리 페이지에는 떼어 쓸 문장이 없는 경우가 많습니다. 해당 질문에 답하는 페이지의 첫 문단과 소제목을 고치는 것이 우선입니다.

몇 번 반복하면 충분한가요?

정해진 수는 없습니다. 중요한 것은 매 주기 같은 회차 수를 유지해 비교 가능하게 만드는 것입니다. 회차를 늘리면 정밀해지지만 비용이 늘어나므로 질문 수와 함께 정합니다.

G
어딧지 편집팀검색·AI 노출 리서치 · 지어낸 수치와 고객 실명 없이, 근거를 먼저 적습니다.

관련 용어(위키)

  • GEO(생성형 엔진 최적화) — GEO(Generative Engine Optimization, 생성형 엔진 최적화)는 ChatGPT·Perplexity·구글…
  • AEO(답변 엔진 최적화) — AEO(Answer Engine Optimization, 답변 엔진 최적화)는 사용자의 질문에 검색엔진·AI 가 그대로 가져다…
  • 네이버 AI 브리핑 — 네이버 AI 브리핑은 네이버 통합검색 상단에 검색어에 대한 답을 생성형 AI 가 요약해 보여 주는 블록이다. 출처 구성(블로그…
  • AI 검색봇(AI 크롤러) — AI 검색봇(AI crawler)은 AI 서비스가 학습 데이터 수집이나 검색 답변 생성을 위해 웹페이지를 가져가는 크롤러다. …
  • llms.txt — llms.txt 는 사이트 루트에 두는 마크다운 파일로, AI(LLM)가 사이트의 핵심 내용과 중요한 페이지 목록을 빠르게 파…

다른 컬럼