Falcon Information — 메인 페이지로

ChatGPT 검색 결과의 출처 및 방법, 그리고 한계

ChatGPT 검색 결과에는 출처 링크가 함께 제공되어, "ChatGPT에서 어떻게 인용되는가"가 흔한 질문이 됩니다. 솔직한 답변은 다음과 같습니다. OpenAI는 공식적인 순위 알고리즘을 공개하지 않으며, "인용 알고리즘"을 "이해"한다고 주장하는 모든 내용은 추측일 뿐입니다. 본 글에서는 공식 문서에서 확인할 수 있는 메커니즘과, 실제로 사용하면서 관찰한 방법(제한 사항 포함)을 정리했습니다.

Eric Tsai엔드 투 엔드 엔지니어 및 디지털 제품 개발자 게시2026-08-12 마지막 업데이트2026-08-31

본 섹션

  • ·공식적으로 확인 가능한 절차
  • ·인용은 어떻게 생성하는가
  • ·고정 쿼리 세트 방법
  • ·방법의 한계
  • ·콘텐츠 측면에서 어떤 것을 할 수 있을까요?
  • ·트래픽은 어떻게 측정하는가

공식 문서에서 확인할 수 있는 3가지 유형의 뱀

OpenAI는 세 가지 목적에 맞는 사용자 에이전트를 공개했습니다. 콘텐츠 제공자는 이를 분리하여 관리할 수 있습니다. OAI-SearchBot은 검색 인덱스를 구축하고 웹사이트를 ChatGPT 검색 결과에 포함시키는 데 사용됩니다. ChatGPT-User는 사용자가 대화 중에 웹 페이지를 읽도록 요청할 때 사용되는 실시간 기능입니다. GPTBot은 모델 훈련 데이터 수집에 사용됩니다. 세 가지 에이전트는 robots.txt에서 독립적으로 작동하도록 설정되어 있습니다. GPTBot을 차단하는 것은 ChatGPT 검색에서 제외되지 않음을 의미하며, 검색 가능성을 높이려면 OAI-SearchBot에 대한 접근 권한을 허용해야 합니다.

OpenAI의 세 가지 사용자 에이전트의 용도 구분
User agent용도ChatGPT에서 참고 자료를 검색할 때
OAI-SearchBot검색 인덱스 생성 및 링크 표시반드시 허용
ChatGPT-User사용자가 페이지 내용을 즉시 읽도록 요청권장하는 방향
GPTBot모델 훈련 데이터 수집콘텐츠 이용 약관에 따라 자유롭게 결정

인용은 어떻게 발생하는가? 확인 가능한 것과 확인 불가능한 것

확인 가능한 부분: ChatGPT 검색은 질문에 대한 검색, 여러 출처를 종합하여 답변을 생성하고, 답변 옆에 출처 링크를 제공합니다. 확인 불가능한 부분: 출처의 순서, 왜 A를 선택하고 B를 선택하지 않았는지, 콘텐츠의 특징이 얼마나 중요하게 평가되는지 – 이러한 내용은 OpenAI에서 공개하지 않습니다. 시장에서 발표되는 "ChatGPT 인용 지수 연구"는 대부분 제3자가 샘플을 기반으로 역추론한 결과이며, 참고할 수 있지만, 이러한 결론을 인용할 때는 추론임을 명시해야 하며, 플랫폼 규칙처럼 표현해서는 안 됩니다. 저희의 입장: 검증 가능한 부분을 먼저 확보하고, 관찰을 통해 추측을 대체합니다.

저희의 관찰 방법: 고정 쿼리 세트

방법은 고정된 문제 목록을 만들고, 정기적으로 ChatGPT를 재검사하여 결과를 기록하는 것입니다. 주요 내용은 다음과 같습니다.; 질문은 "고객이 의사 결정을 할 때 실제로 질문할 것" (예: 서비스 비교, 가격 문의)으로 구성합니다. 브랜드 이름만 측정하는 것은 기존 인식을 반영할 뿐입니다.; 매번 새로운 대화를 시작하여 문맥에 따른 답변을 피합니다.; 각 질문에 대해 날짜, 브랜드 언급 여부, 참조된 웹사이트 및 페이지를 기록합니다.; 동일한 문제 목록을 매월 재검사하여 트렌드 변화를 파악하고, 단일 결과에 집중하지 않습니다. 이 방법은 매우 저렴합니다. 간단한 표와 일관된 실행 규칙만 있으면 됩니다.

이 방법의 한계점을 먼저 명확하게 설명해야 합니다.

고정 쿼리 세트에는 명확한 제한 사항이 있으며, 보고서에서는 다음과 같이 명시하고 있습니다. "AI 답변에는 무작위성이 존재하며, 동일한 질문을 두 번 질문하면 다른 출처에서 답변을 받을 수 있습니다. 답변은 계정, 지역 및 모델 버전에 따라 달라지며, 사용자가 보는 것과 동일하지 않습니다. 모델 또는 제품 버전이 변경되면 전체 기준이 재설정될 수 있습니다. 따라서 이 쿼리 세트는 "우리 브랜드의 이 문제에 대한 상대적인 추세"만을 답변할 수 있으며, 시장 점유율이나 노출량에 대한 추론은 불가능합니다. "ChatGPT에서 추천"이라고 주장하는 보고서의 경우, 신뢰도가 낮게 평가해야 합니다.

콘텐츠를 통해 무엇을 할 수 있을까요?

숨겨진 알고리즘을 쫓기보다는 검증 가능한 기반을 구축하는 것이 더 중요합니다. 이러한 접근 방식은 전통적인 검색과 모든 AI 플랫폼에 적용될 수 있습니다. 구체적으로, OAI-SearchBot이 웹 페이지를 수집할 수 있는지 (robots.txt 및 WAF를 포함한) 확인하고, 중요한 내용은 HTML 내에 명확하게 표시되어야 하며, 답변을 먼저 제시하는 방식으로 작성하여, 증거와 실명 정보를 활용하여 신뢰성을 확보해야 합니다. 또한, 브랜드 이름과 회사 정보가 웹 전체에서 일관성을 유지하여 혼동을 줄여야 합니다.

인용 후, 트래픽은 어떻게 측정할까요?

OpenAI 공식 설명에 따르면, ChatGPT 검색 시 자동으로 `utm_source=chatgpt.com`이 추가되므로, GA4에서 캠페인 소스와 세션 소스를 함께 사용하여 ChatGPT 그룹을 만들 수 있습니다. 이를 통해 랜딩 페이지, 사례, CTA, 문의 등을 확인할 수 있습니다. 하지만 모든 ChatGPT 노출이 측정되는 것은 아닙니다. 클릭이 없으면 방문 데이터가 없으며, 앱 실행, 개인 정보 제한, 리디렉션 또는 파라미터 제거 시에도 리퍼럴 또는 직접 방문으로 분류될 수 있습니다. 보고서에는 UTM 및 리퍼러를 함께 확인하고, 단순 세션 수만으로 가치를 판단하는 대신, 후속 문의를 통해 가치를 파악해야 합니다.

참고 자료

자주 묻는 질문

GPTBot을 차단한 후에는 ChatGPT에서 해당 내용이 더 이상 나타나지 않는 걸까요?
그렇지 않습니다. GPTBot은 훈련 데이터 수집을 담당하고, OAI-SearchBot은 인용 검색을 담당합니다. GPTBot과 OAI-SearchBot을 모두 사용하면, 이론적으로는 ChatGPT 검색 결과에 인용된 내용이 나타날 수 있습니다. 또한, 현재 robots.txt를 통해 제어할 수 없는 과거 훈련 데이터와 제3자에서 재게시한 콘텐츠도 존재합니다.
ChatGPT 검색 결과가 Bing의 인덱스와 관련이 있나요?
OpenAI와 마이크로소프트는 협력 관계를 맺고 있으며, ChatGPT의 검색 기록 일부는 Bing의 기반을 활용하지만, OpenAI는 자체 인덱스(OAI-SearchBot)를 구축했습니다. 하지만 이 부분에 대한 공식적인 문서는 아직 없습니다. 실질적인 방법은 Bing Webmaster Tools를 통해 정보를 제공하는 것이지만, "Bing SEO를 통해 ChatGPT에 진입하는 것"을 보장하는 방법은 아닙니다.
검사를 몇 번 반복하는 것이 합리적인가요?
저희의 템포는 매월 한 번, 그리고 분기별 검토를 병행합니다. 너무 자주 진행하면 의미가 없으며, AI 답변의 무작위 변동이 실제 변화를 가릴 수 있습니다. 반대로 너무 오래 지나면 모델 업데이트로 인한 변화를 파악하기 어려울 수 있습니다. 중요한 것은 각 재검사의 조건(질문, 표현, 새로운 대화)이 일관성을 유지하는 것입니다.

관련 요구 사항이 있으신가요?

문의하기