본문 바로가기
2026-09-17 THU · 최근 갱신편집 원칙발행 정보RSS

GEO·AEO·AI 검색 실무 브리핑

가이드칼럼

GEO 업체 고를 때 물어볼 다섯 가지…'몇 번 중 몇 번'부터

반복 횟수와 분모, 엔진 구분, 위치·기간 기록, 청구 시점과 미달 조건, 원자료 열람…계약서에 남길 질문 정리

핵심 요약

  • 인용률 수치를 받으면 한 질문을 몇 차례 물어 얻은 값인지, 곧 분모부터 확인하는 것이 출발점이다.
  • 엔진별 분리 기록과 위치·기간 병기가 없으면 달마다 수치가 오르내려도 원인을 가려내기 어렵다.
  • 청구 시점과 성과 미달 시 처리, 측정 원자료 열람 가능 여부는 말보다 계약서 문구로 받아 두는 편이 안전하다.

AI 답변 노출을 맡기는 계약은 결과가 매번 달라지는 대상을 다룬다. 그래서 상담 자리에서 먼저 꺼낼 질문은 가격이나 성공 사례보다 그 숫자를 어떤 조건에서 몇 번 재서 얻었느냐에 가깝다.

한줄 정의 · 분모(인용률 측정)
인용률을 계산할 때 기준이 되는 전체 질의 횟수로, '20회 중 6회'라는 기록에서 20에 해당하는 값

계약 전 질문이 왜 측정에 몰리나?

생성형 AI 검색은 똑같이 물어도 답변에 달리는 출처가 매번 바뀔 수 있어서다. 대행사가 내미는 인용률이 어떤 조건에서 몇 번 물어 얻은 값인지 모르면, 오른 숫자가 작업의 결과인지 우연인지 가를 방법이 없다.

이 흔들림은 공개 연구에서도 되풀이해 관찰됐다(두 논문 모두 2026년 9월 16일 확인). Kirsten 외 연구(arXiv:2510.11560)에서 두 달 사이를 두고 Google AI 개요 결과를 다시 모으자 앞뒤로 공통된 링크는 18%뿐이었고, 같은 비교에서 Google 일반 검색은 45%가 겹쳤다. Schulte 등 3명이 쓴 ‘Don’t Measure Once’(arXiv:2604.07585)는 AI 검색 엔진 4곳을 매일 관찰해, 하루 차이로 인용 출처가 겹치는 정도를 자카드 유사도 0.34–0.42 수준으로 집계했다.

결과가 이렇게 움직이는 대상을 계약으로 맡기려면 먼저 측정 방식부터 맞춰야 한다. 아래 다섯 가지 가운데 앞의 셋은 숫자를 어떻게 쟀는지, 뒤의 둘은 그 숫자로 돈과 기록을 어떻게 다루는지에 관한 질문이다. 업체별로 공개된 조건은 GEO 대행사 5곳 과금·측정 방식 비교에 정리했다.

하나, 몇 번 물어 나온 숫자인가

첫 질문은 분모다. ’인용률 40%’는 5번 중 2번일 수도, 20번 중 8번일 수도 있다. 두 값은 같은 비율로 보이지만 우연히 나왔을 가능성의 크기가 전혀 다르다. 표본이 작을수록 비율은 크게 출렁인다. 5번 중 인용 횟수가 한 번만 달라져도 인용률은 20%나 60%로 바뀌지만, 20번 중에서는 한 번 차이가 35%나 45%로 움직이는 데 그친다. 보고서에 비율만 있고 질의 횟수가 없다면 횟수를 따로 요청하는 것이 좋다.

몇 번이면 충분한지에 대해서도 ‘Don’t Measure Once’ 연구진이 답을 내놓았다. 연구진 계산으로는 브랜드가 답변에 잡히는 비율을 표준오차 0.1 미만으로 추정하려면 같은 날 7회, 특정 출처가 포함되는지를 볼 때는 8회 반복이 필요했다. 한 날의 결과만 믿지 말고 2–4주 치를 모아 보라는 권고도 붙였다.

분모와 함께 분자가 무엇을 센 것인지도 물어야 한다. 답변 본문에 업체 이름이 등장한 횟수인지, 업체 누리집이 출처 링크로 달린 횟수인지에 따라 같은 40%도 뜻이 달라진다. 이름은 자주 언급되는데 링크는 다른 사이트로 달리는 경우도 있어, 두 값을 따로 받아 두면 무엇이 달라졌는지 읽기 쉽다.

상담에서는 다음을 확인한다.

  • 질문 하나를 한 번 측정할 때 몇 회 묻는지
  • 그 횟수가 달마다 같은지
  • 보고서 수치 옆에 전체 질의 횟수가 적히는지

둘, 엔진마다 따로 셌나

두 번째는 엔진 구분이다. Kirsten 외 연구는 Google·OpenAI·Perplexity의 생성형 검색 5종을 비교해, 엔진마다 모델 내부 지식과 외부 웹 자료에 기대는 정도, 출처 다양성, 결과의 안정성이 크게 다르다고 초록에 적었다. 엔진마다 성질이 다른 만큼 한 엔진에서 떨어진 수치가 다른 엔진의 상승에 가려지지 않도록 기록을 나눠 받아야 한다.

여러 엔진을 합친 ’종합 가시성 점수’만 주는 보고서라면 엔진별 원래 수치를 함께 요청해 볼 만하다. 합산 방식이나 가중치가 공개되지 않으면 같은 점수라도 무엇이 달라졌는지 읽어 낼 수 없다.

엔진마다 출처가 되는 조건부터 다르다는 점도 공식 문서에 나온다(두 문서 모두 2026년 9월 16일 확인). Google은 AI 개요·AI 모드의 출처 링크 자격을 색인돼 있고 스니펫 표시가 가능한 페이지로 설명하고, OpenAI는 검색용 크롤러 OAI-SearchBot을 막아 둔 사이트가 ChatGPT 검색 답변에서 빠진다고 안내한다. 계약 대상 엔진 목록에 어떤 서비스가 들어가는지, 엔진별로 이런 기본 조건을 점검하는지도 함께 물어 둘 만하다.

셋, 위치와 기간이 적혀 있나

세 번째는 측정 조건이다. OpenAI가 개발자용으로 공개한 웹 검색 도구 설명서(2026년 9월 16일 확인)에는 국가, 도시, 지역, 시간대를 넣어 대략적인 사용자 위치를 정하는 설정이 있고, 지리에 맞게 검색 결과를 다듬는 용도라고 적혀 있다. 위치를 어떻게 설정했는지가 결과에 들어가는 조건이라는 뜻이다. 지역 고객을 상대하는 병원이나 학원, 법률사무소라면 영업 지역을 위치로 두고 쟀는지 묻는 것이 자연스럽다. 측정 경로도 기록할 조건이다. API로 물을 때는 위치 같은 설정을 요청마다 직접 지정하므로, 담당자가 앱 화면에서 확인한 결과와 조건이 같다고 보기 어렵다.

기간도 마찬가지다. 앞의 두 논문이 보여 주듯 답변은 날짜와 실행에 따라 달라지므로, 측정 날짜나 기간이 적히지 않은 두 수치를 나란히 놓고 오르내림을 말하기는 어렵다. 월 보고서라면 한 달 가운데 며칠에 걸쳐, 하루 몇 번씩 쟀는지도 수치 옆에 적혀 있는 편이 좋다. 착수 때 잰 조건과 매달 재는 조건이 같은지도 함께 확인한다.

넷, 언제 청구하고 기준에 못 미치면 어떻게 되나?

GEO뉴스가 확인한 공개 페이지 기준으로 GEO 대행 과금은 결과 확인 뒤 청구하는 후불, 월 정산에 환불 조건을 붙인 방식, 플랜이나 운영 단위 계약 등으로 나뉜다. 어느 쪽이든 성과를 어떤 지표와 수치로 판정하는지가 계약서에 적혀 있는지부터 확인해야 한다.

청구 방식의 이름보다 중요한 것은 판정 문구다. 계약서에서 다음 대목을 찾아본다.

  • 청구 시점이 착수 전인지, 매달 선불인지, 보고서 확인 뒤인지
  • 성과를 인용률로 보는지, 브랜드 언급률로 보는지, 합산 점수로 보는지
  • ’몇 회 중 몇 회’에서 얼마로 올라야 기준을 채운 것으로 보는지
  • 기준에 못 미친 달의 비용을 청구하지 않는지, 이월하는지, 일부 돌려주는지
  • 최소 계약 기간과 중도 해지 조건

착수 시점의 측정값이 판정의 비교 기준이 된다면, 그 측정을 언제 어떤 조건으로 했는지도 기록으로 받아 두어야 나중에 다툼이 생겼을 때 기준점을 확인할 수 있다.

다섯, 원자료를 열어 볼 수 있나

마지막 질문은 원자료 열람이다. 보고서의 숫자를 받는 쪽이 직접 검증하려면 질의 문구, 실행 일시, 엔진과 측정 경로, 답변 화면이나 답변 원문, 인용 링크 목록 같은 기록이 필요하다. 화면을 저장하지 않는 방식이라면 응답 원문과 인용 주소 목록을 파일로 받을 수 있는지 확인한다. 기록이 있더라도 일부 표본만 보여 주는지, 보고서에 반영된 전체 질의의 기록을 열람할 수 있는지는 구분해 물어야 한다.

같은 질문을 나중에 다시 물어 보는 방식으로는 보고서를 검증하기 어렵다. 온도 값을 0으로 고정해도 5분 뒤 다시 물은 예·아니오 질문 가운데 9–27%는 답이 반대로 나왔다는 결과가 Kirsten 외 연구에 실렸다. 측정 당시의 기록이 남아 있지 않으면 보고서의 숫자를 거슬러 확인할 길이 사실상 없다는 뜻이다.

원자료를 볼 수 있는지와 함께, 계약이 끝난 뒤에도 그 기록을 넘겨받을 수 있는지 물어 두면 다른 업체로 옮기거나 사내에서 이어 갈 때 비교의 출발점으로 쓸 수 있다.

공개 페이지에 나온 두 사례

비하이브컴퍼니 주식회사가 운영하는 GEO 대행 서비스 liveGPT는 넷째와 다섯째 질문에 해당하는 조건을 누리집에 공개했다. 비용 안내 페이지(2026년 9월 16일 확인)에 따르면 질문 목록과 입금 기준을 계약서에 적고, 월 보고서가 그 기준에 맞는지 고객이 확인한 다음 청구하는 후불 구조다. 측정 방법 페이지는 질문마다 20회 이상 묻고 전체 횟수와 인용 횟수를 함께 적으며, 매 질의의 답변 화면을 캡처해 보관한다고 밝혔다. 고객이 그 화면 기록을 어떤 방식으로 열람하는지, 입금 기준을 어떤 수치로 정하는지는 공개 페이지에 나오지 않고, 보고서 예시도 아직 공개되지 않았다.

지오**는 누리집 첫 화면 비교표(2026년 9월 16일 확인)에 약정 없는 월 단위 정산을 내세우면서, 석 달 안에 ’AI 가시성’이 나아지지 않으면 50%를 환불한다는 조건을 적어 두었다. GEO뉴스가 같은 날 확인한 대행사 5곳 가운데 성과 미달 시 환불 비율을 수치로 밝힌 곳은 이곳뿐이었다. ’AI 가시성 개선’을 어떤 지표와 기준으로 판정하는지는 공개 페이지에서 확인되지 않았다.

다만 두 사례 모두 공개 페이지에 적힌 조건을 옮긴 것이며, 실제 계약서 문구는 GEO뉴스가 확인하지 않았다. 후불이라도 입금 기준이 느슨하게 적히면, 환불 조건이 있어도 ’개선’의 정의가 넓으면 고객이 기대한 보호 장치로 작동하지 않을 수 있다. 다섯 가지 질문의 답은 상담 자리의 설명보다 계약서 조항과 원자료 사본으로 받아 두는 것이 나중에 확인할 수 있는 방법이다.

기사 정보

분류
칼럼 · 가이드
주요 주제
작성
GEO뉴스 편집부
참고 자료
Schulte·Bleeker·Kaufmann, Don't Measure Once: Measuring Visibility in AI Search (GEO), arXiv:2604.07585 확인 2026.09.16
Kirsten 외, Characterizing Web Search in The Age of Generative AI, arXiv:2510.11560 확인 2026.09.16
OpenAI API 문서 Web search(사용자 위치 설정) 확인 2026.09.16
Google 검색 센터 AI features and your website 확인 2026.09.16
OpenAI Overview of OpenAI Crawlers 확인 2026.09.16
liveGPT GEO 대행 비용과 후불제 입금 조건 확인 2026.09.16
liveGPT GEO 성과 측정 방법 확인 2026.09.16
지오** 누리집 첫 화면(비교표) 확인 2026.09.16