AI 답변 인용 측정이 어긋나는 세 가지 원인과 바로잡는 조건
정의
AI 답변 인용 측정은 생성형 AI 검색 엔진이 질문에 답할 때 특정 웹 문서를 근거로 인용하는지를, 같은 질문을 정해진 조건으로 반복해 확인하는 측정입니다.
개요
AI 답변에 자사 글이 인용되는지 측정하려면 먼저 세 가지 조건을 맞춰야 합니다. 첫째는 웹 검색을 켠 호출이고, 둘째는 사용자가 실제로 묻는 문장이며, 셋째는 중복 기록을 한 건으로 합친 집계입니다.
비즈스프링은 2026년 7월 29일부터 9월 28일까지 자사 콘텐츠를 ChatGPT와 Perplexity로 측정한 기록 1,052건을 대조했고, 2026년 9월 28일에는 Perplexity, ChatGPT, Gemini 세 엔진에 같은 질문을 웹 검색 조건으로 다시 물었습니다. 세 조건이 각각 측정 결과를 어떻게 바꾸는지 두 자료로 확인했습니다.
원인 1. 웹 검색을 끈 호출은 새 글을 인용할 수 없습니다
ChatGPT API를 기본 설정으로 호출하면 모델은 웹을 검색하지 않고 학습된 지식으로만 답합니다. 학습 이후에 게시된 글은 처음부터 인용 후보에 들어가지 않습니다. 비즈스프링 측정 기록에서 ChatGPT 호출 526건은 인용 URL 필드가 모두 비어 있었고, 입력 토큰은 평균 61개였습니다. 검색 결과가 답변에 붙지 않았다는 뜻입니다. 같은 기간 Perplexity 호출 526건은 모두 인용 URL 목록을 반환했습니다.
2026년 9월 28일에는 같은 질문을 웹 검색 도구를 반드시 쓰도록 설정해 다시 물었습니다. 「GEO 자동 재진단 주기는 어떻게 설정하는 게 좋아?」라는 질문에 ChatGPT는 geocare.ai의 FAQ 페이지를 1순위로, 비즈스프링 위키의 자동 재진단 가이드를 2순위로 인용했습니다. 측정 기록에서 0건이던 결과가 측정 방식을 바꾸자 달라졌습니다.
| 측정 조건 | 인용 URL 반환 | 자사 글 인용 |
|---|---|---|
| ChatGPT API 기본 호출 (웹 검색 없음) | 526건 중 0건 | 0건 |
| Perplexity API 기본 호출 (웹 검색 포함) | 526건 중 526건 | 고유 URL 226개 중 9개 |
| ChatGPT 웹 검색 필수 설정 (2026-09-28) | 질문 7개 중 6개 | 브랜드 고유 주제 질문에서 2순위 |
원인 2. 브랜드명을 넣은 질문은 결과를 실제보다 유리하게 만들기 쉽습니다
측정 기록 526건 가운데 415건은 「비즈스프링의 {글 제목}에 대해 알려줘」 형태였습니다. 이런 질문은 AI가 브랜드 공식 페이지를 찾도록 유도하기 때문에, 브랜드를 모르는 사용자가 묻는 질문에서 얼마나 인용되는지는 측정하지 못합니다.
2026년 9월 28일 재측정에서도 차이가 뚜렷했습니다. 브랜드명을 넣은 질문에서는 세 엔진 모두 비즈스프링 관련 페이지를 1순위로 인용했습니다. 반면 「AEO와 GEO는 무엇이 다른가요?」처럼 브랜드명이 없는 일반 주제 질문 4개에서는 세 엔진 모두 비즈스프링 페이지를 인용하지 않았습니다. 브랜드 고유 주제 질문 2개에서는 Perplexity가 두 질문 모두 비즈스프링 계열 도메인을 1순위로 인용했습니다. 다만 이 비교는 주제가 서로 다른 질문끼리의 비교이므로, 차이를 브랜드명 하나의 효과로 단정할 수는 없습니다.
그래서 측정 질문은 브랜드 질문, 브랜드 고유 주제 질문, 일반 주제 질문의 세 종류로 나누고 결과도 따로 집계해야 합니다. 브랜드명의 영향만 따로 보려면 같은 질문을 브랜드명을 넣은 형태와 뺀 형태로 짝지어 함께 측정합니다.
원인 3. 같은 기록을 여러 번 세면 인용 건수가 부풀고 인용률이 치우칩니다
한 글을 여러 채널에 동시에 게시하면 게시 기록은 여러 건이 생기지만 공개 URL은 하나일 수 있습니다. 비즈스프링 측정 기록에는 엔진별로 같은 URL, 같은 질문, 같은 날짜(한국 시간 기준)로 겹친 묶음이 52개씩 있었고, 한 URL이 한 번 인용되면 세 건으로 계산되는 경우도 있었습니다.
중복이 인용률을 늘 높이지는 않습니다. 인용된 기록이 반복되면 인용률이 올라가고, 인용되지 않은 기록이 반복되면 내려가므로 결과가 반복된 쪽으로 치우칩니다. 비즈스프링 원장의 Perplexity 기록에서는 인용 건수가 중복을 합치기 전 13건에서 합친 뒤 11건으로 줄었지만, 인용률은 합치기 전 526건 중 2.47%, 합친 뒤 441건 중 2.49%로 거의 같았습니다. 건수만 보면 성과가 과장되고, 인용률이 어느 쪽으로 움직일지는 원장마다 다릅니다.
인용률은 계산 단위도 함께 밝혀야 합니다. 중복을 합친 응답 단위로 보면 Perplexity 답변이 측정 대상 글을 인용한 비율은 441건 중 11건(2.49%)이고, 글 단위로 보면 한 번 이상 인용된 글은 226개 중 9개(4.0%)입니다. 두 지표는 분모가 다르므로 따로 적습니다.
측정 결과
| 항목 | 값 | 기준 |
|---|---|---|
| 측정 기록 | 1,052건 (ChatGPT 526건, Perplexity 526건) | 2026-07-29 ~ 2026-09-28 |
| ChatGPT 인용 URL 반환 | 526건 중 0건 | 웹 검색 없는 기본 호출 |
| 브랜드명 고정 질의 | 엔진별 526건 중 415건 | 「비즈스프링의 {글 제목}에 대해 알려줘」 형태 |
| 중복 묶음 | 엔진별 52개 | 같은 URL·질문·날짜(한국 시간) |
| Perplexity 응답 단위 인용률 | 합치기 전 13/526 (2.47%), 합친 뒤 11/441 (2.49%) | 응답 1건 = URL·질문·날짜 |
| Perplexity 글 단위 인용 | 226개 중 9개 (4.0%) | 한 번 이상 인용된 글 |
| ChatGPT 웹 검색 필수 재측정 | 질문 7개 중 6개에서 인용 URL 반환 | 2026-09-28 |
세 조건을 맞춘 측정 설계
- 호출: 웹 검색을 반드시 사용하도록 설정합니다. ChatGPT는 검색 도구를 필수로 지정하고, Gemini는 구글 검색 근거를 켜고, Perplexity는 기본 검색을 사용합니다.
- 질문: 브랜드 질문, 브랜드 고유 주제 질문, 일반 주제 질문을 구분해 기록하고, 브랜드명의 영향은 같은 질문의 브랜드명 포함·제외 짝으로 측정합니다.
- 집계: URL, 질문, 엔진, 측정일이 모두 같은 기록만 한 건으로 합치고, 질문이나 날짜가 다른 측정은 각각 따로 셉니다. 인용 여부와 함께 인용 순위를 기록합니다.
- 시점: 게시 전 기준선을 먼저 측정하고, 게시 후 7일, 14일, 30일에 같은 질문으로 다시 측정합니다.
게시 후 인용까지 걸리는 기간
비즈스프링 자사 사례 1건에서는 Perplexity가 게시 7일 후 측정에서 해당 글을 2순위로 인용했고, 14일과 30일 측정에서는 1순위로 인용했습니다. 사례가 1건이므로 이 기간을 일반적인 기준으로 쓰기에는 표본이 부족합니다. 비즈스프링은 같은 설계로 측정 사례를 더 확보한 뒤 기간을 다시 정리할 예정입니다.
자주 묻는 질문
ChatGPT API로 인용을 측정하면 왜 0%가 나오나요?
기본 API 호출은 웹을 검색하지 않고 학습된 지식으로만 답하므로, 학습 이후에 게시된 글은 인용 후보가 되지 않습니다. 웹 검색 도구를 반드시 쓰도록 설정해야 게시된 글이 인용 후보가 될 수 있고, 실제 인용은 그 글이 검색 엔진에 색인돼 질문의 검색 결과에 나타날 때 일어납니다.
AI 인용 측정 질문에 브랜드명을 넣으면 어떤 문제가 생기나요?
브랜드 공식 페이지가 인용될 가능성이 높아져 결과가 실제보다 유리하게 나오기 쉽습니다. 브랜드를 모르는 사용자가 묻는 질문에서의 경쟁력을 보려면 브랜드명이 없는 질문을 따로 측정하고 따로 집계해야 합니다.
AI 답변 인용은 어떻게 측정해야 정확한가요?
웹 검색을 켠 호출, 사용자가 실제로 묻는 문장, 중복 기록을 한 건으로 합친 집계라는 세 조건을 맞춥니다. 그다음 게시 전 기준선과 게시 후 재측정을 같은 질문으로 비교합니다.
관련 항목
- Citation Moat 전략: SoM과 클릭의 괴리에서 시작하는 GEO 측정
- GEOcare 자동 재진단 설정 가이드: 같은 질문을 주기적으로 다시 측정하는 방법
- 4 LLM 평가 프롬프트 공개 v1: 엔진별 평가 방법론
- 자사 GEO 도그푸딩 출발점: 자사 측정의 기준선
외부 출처
- OpenAI, Web search 가이드: developers.openai.com/api/docs/guides/tools-web-search
- Google, Grounding with Google Search: ai.google.dev/gemini-api/docs/google-search
- Perplexity, Sonar API 레퍼런스: docs.perplexity.ai/api-reference/sonar-post
메타
- 작성·검수: BizSpring Wiki PO (찰스 / 이철승)
- 분류: Article / GEO 측정 / AI 답변 인용
- 근거 자료: 비즈스프링 콘텐츠 인용 측정 원장 1,052건(2026-07-29 ~ 09-28), 세 엔진 재측정 원자료(2026-09-28)
- BizPO 참조: SOL-01 GEOcare
- 최종 갱신: 2026-09-29