GEO / 생성형 엔진 최적화

챗GPT와 퍼플렉시티, 인용 소스가 89% 다르다 — GEO는 뭘 보나?

읽는 데 7분 INSIGHTX
챗GPT와 퍼플렉시티, 인용 소스가 89% 다르다 — GEO는 뭘 보나?

그렇습니다. 인용 추적 업체 Wellows가 2026년 1~6월 다섯 개 AI 엔진의 인용 2,274만 9,707건을 분석한 결과, 퍼플렉시티는 ChatGPT가 같은 질문에서 인용한 소스의 89%를 전혀 쓰지 않았습니다. 한 엔진에서 인용됐다고 다른 엔진에서도 인용되리라 기대하기는 어렵다는 뜻입니다.

AI 엔진끼리 인용 소스가 실제로 얼마나 겹칠까?

Wellows는 ChatGPT·퍼플렉시티·구글 AI 개요·구글 AI 모드·Gemini 다섯 엔진에 던진 질문 114만 6,483건에서 나온 인용 2,274만 9,707건을 모았습니다. 이 중 다섯 엔진이 모두 무언가를 인용한 질문은 53만 1,889건이었고, 여기서 나온 '사이트×질문' 조합 872만 9,964개를 비교해 교차 인용률을 계산했습니다.

결과는 대부분의 엔진 쌍에서 겹치는 비율이 10%를 넘지 않았습니다. 같은 질문에 대해서도 두 엔진이 공통으로 인용한 소스는 소수에 그쳤다는 뜻입니다.

엔진 쌍교차 인용률
구글 AI 개요 – 퍼플렉시티9.3%
구글 AI 모드 – 퍼플렉시티8.3%
Gemini – 퍼플렉시티7.4%
구글 AI 개요 – ChatGPT6.9%
구글 AI 모드 – ChatGPT6.5%
ChatGPT – 퍼플렉시티6.5%
Gemini – ChatGPT6.1%

왜 이렇게 인용 소스가 갈릴까?

Wellows는 각 엔진 쌍이 원래부터 후보로 삼는 소스 풀(candidate pool)이 얼마나 겹치는지를 따로 보정해 다시 계산했습니다. 그 결과 실제 공동 인용은 완전히 무작위로 골랐을 때보다 10.5배에서 19.7배 더 자주 일어났고, 가장 높은 쌍은 Gemini와 퍼플렉시티(19.7배)였습니다. 즉 교차율 수치 자체는 낮지만 우연이 아니라, 각 엔진이 서로 다른 인덱스·크롤러·최신성 가중치를 쓰기 때문에 생기는 구조적인 차이라는 뜻입니다.

그럼 GEO 담당자는 오늘 뭘 확인해야 하나?

한 엔진에 맞춰 페이지를 고쳤다고 해서 다른 엔진의 인용까지 늘어난다고 가정하기는 어렵습니다. 엔진별로 인용 여부를 나눠서 확인하는 절차가 먼저입니다. 서치 콘솔의 생성형 AI 리포트로 구글 AI 개요·AI 모드 노출을 보고, ChatGPT와 퍼플렉시티에는 실제 질문을 직접 입력해 결과를 확인합니다.

서버 로그에서 GPTBot·PerplexityBot·Google-Extended 접속을 구분해서 보는 것도 필요합니다. 특정 크롤러가 애초에 페이지를 가져가지 않고 있다면, 인용 문구를 다듬는 것보다 접근 차단 여부를 먼저 점검해야 합니다.

엔진마다 별도로 확인하고 별도로 보강한다 — 교차 인용률이 10%를 밑도는 상황에서는 이 방식이 하나의 '만능 최적화'보다 실제로 인용을 늘리는 데 더 가깝습니다.

정리하면, Wellows의 2,274만 건 분석에서 퍼플렉시티는 ChatGPT가 인용한 소스의 89%를 같은 질문에서도 쓰지 않았고, 엔진 쌍 대부분의 교차 인용률은 6~9%대에 그쳤습니다. 이는 우연이 아니라 엔진별 인덱스와 크롤러 구조가 다르기 때문이며, GEO 담당자는 엔진 하나의 인용 성공을 전체 성공으로 오해하지 말고 엔진별로 인용 여부를 따로 점검해야 합니다.

Q & A

자주 묻는 질문

여러 AI 엔진에 대응하려면 콘텐츠를 엔진별로 따로 만들어야 하나요?
따로 만들 필요는 없습니다. 질문형 소제목, 문단 하나에 논지 하나, 수치와 출처를 명시하는 구조는 모든 엔진에 공통으로 유리합니다. 대신 어느 엔진에 인용되고 어느 엔진에서 빠지는지를 따로 확인해, 빠진 엔진이 선호하는 근거(최신성, 통계, 원문 인용문 등)를 그 페이지에 보강하는 방식이 효율적입니다.
우리 사이트가 어떤 AI 엔진에 인용되는지 어떻게 확인하나요?
구글 서치 콘솔의 생성형 AI 리포트로 AI 개요·AI 모드 노출을 보고, ChatGPT·퍼플렉시티에는 실제 질문을 직접 입력해 인용 여부를 확인합니다. 서버 로그에서 GPTBot·PerplexityBot·Google-Extended 접속 기록을 구분해서 보면 크롤링 단계에서 이미 제외되고 있는지도 알 수 있습니다.
인용 교차율이 낮은 게 콘텐츠 품질과 관련 있나요?
직접적인 관련은 아닙니다. Wellows 조사가 보여주는 낮은 교차율은 엔진마다 인덱스·크롤러·최신성 가중치가 구조적으로 다른 데서 오는 결과입니다. 다만 특정 엔진에서만 전혀 인용되지 않는다면, 그 엔진이 선호하는 근거 유형이 페이지에 없을 가능성은 점검할 만합니다.
이번 수치가 앞으로도 유지될까요?
확실하지 않습니다. 인용 점유율은 검색엔진의 알고리즘이나 크롤러 정책이 바뀌면 몇 주 안에도 크게 흔들린다는 것이 여러 인용 추적 조사의 공통된 관찰입니다. 이번 조사도 반기 단위 스냅샷이므로, 다음 조사 결과가 나오면 다시 비교해봐야 합니다.

← 저널 목록으로