- GeoAnalytics는 자바스크립트를 실행하지 않는 AI 봇의 방문을 서버사이드에서 페이지 단위로 측정하는 접근을 다뤄요.
- GA·GTM 같은 태그 기반 도구만으로는 ChatGPT·Perplexity 등의 사이트 접근을 확인하기 어려워 서버 로그 관측이 필요해요.
- AI 봇 트래픽 측정은 AI 인용을 보장하는 기능이 아니라, 실제 크롤링과 요청을 확인하는 사실 점검에 가까워요.
목차
GA·GTM만으로 AI 봇을 보기 어려운 이유
GA·GTM은 이용자의 브라우저에서 태그가 실행될 때 데이터를 보내는 구조라서, 자바스크립트를 실행하지 않는 AI 봇의 요청은 원리적으로 잡히지 않아요.
일반 사용자가 웹페이지를 열면 브라우저가 HTML을 읽고 자바스크립트를 실행한 뒤 분석 태그를 호출해요. 반면 AI 봇 대부분은 필요한 문서나 데이터를 가져가기 위해 서버에 HTTP 요청을 보내지만, 브라우저처럼 태그를 실행하지는 않아요. 그래서 GA에 방문 세션이 남지 않더라도 서버에는 해당 요청이 기록될 수 있어요.
| 구분 | 주로 관측하는 대상 | AI 봇 확인과의 관계 |
|---|---|---|
| GA | 태그가 실행된 사용자 행동과 유입 | 자바스크립트를 실행하지 않는 봇은 누락될 수 있음 |
| GTM | 태그를 배포하고 실행하는 관리 구조 | 태그 자체가 실행되지 않으면 수집도 발생하지 않음 |
| 서버 로그 | 웹서버에 들어온 요청과 응답 | 봇의 요청, URL, 시점 등을 확인할 수 있음 |
이는 GA·GTM이 부족해서라기보다 측정 대상과 실행 위치가 다른 문제예요. 사람의 행동 분석에는 태그 기반 도구가 유용하고, AI 봇의 접근 확인에는 서버사이드 관측이 맞는 방식이라고 보면 이해하기 쉬워요.
서버사이드 측정에서 확인할 수 있는 것
서버사이드 측정은 AI 봇이 실제로 어떤 페이지에 요청을 보냈는지 확인하는 데 의미가 있어요.
서버에는 요청 시각, 요청 URL, User-Agent, 응답 상태 같은 정보가 남을 수 있어요. 이를 바탕으로 AI 봇으로 식별되는 요청을 분류하고 페이지별 접근 여부를 살펴볼 수 있어요. 넥스트티의 GeoAnalytics도 서버사이드 수집으로 AI 봇의 방문을 페이지 단위로 측정하는 사례로 소개돼요.
측정의 핵심 흐름
- 웹서버에 들어온 요청을 수집해요.
- AI 봇으로 분류할 신호를 확인해요.
- 요청된 페이지와 시점을 묶어 기록해요.
- 페이지별 접근 사실을 다른 관측 자료와 비교해요.
이런 방식의 AI 봇 트래픽 측정은 GA에 표시되지 않는 요청을 보완하는 데 활용할 수 있어요. 무료로 시작할 수 있다고 알려져 있지만, 수집 범위와 자세한 운영 방식은 공식 안내에서 확인하는 편이 좋아요.
다만 서버에 요청이 기록됐다는 사실과 AI 답변에 사이트가 인용됐다는 결과는 같지 않아요. 봇이 페이지를 가져갔다는 것은 접근의 증거이지, 이후 학습이나 검색 결과 반영, 답변 인용까지 의미하지는 않아요.
GEO Signal을 해석할 때 주의할 점
GEO Signal은 AI가 사이트를 참고했을 가능성을 판단하는 자료로 활용할 수 있지만, 노출이나 인용을 약속하는 지표로 해석하면 안 돼요.
AI 시스템마다 크롤링 방식과 참조 시점이 다르고, 같은 사이트라도 요청한 URL과 응답 조건이 달라질 수 있어요. 따라서 단일 접속 기록만 보고 특정 AI 서비스의 답변에 포함됐다고 단정하기보다, 시간에 따른 요청과 페이지 분포를 관찰하는 편이 합리적이에요.
| 관측 신호 | 알 수 있는 내용 | 알 수 없는 내용 |
|---|---|---|
| 특정 AI 봇의 서버 요청 | 해당 봇으로 식별되는 접근 가능성 | 답변 인용 여부 |
| 페이지별 요청 기록 | 어떤 URL이 요청됐는지 | 페이지 내용이 실제로 어떻게 처리됐는지 |
| 반복되는 시점과 패턴 | 접근이 일회성인지 반복적인지 | 검색 결과나 답변 순위의 변화 |
AI 답변의 출처와 생성 방식까지 함께 이해하려면 자세한 기준을 검색 증강 생성(RAG) 자료에서 확인할 수 있어요. 다만 서버 측정 결과와 답변 결과는 서로 다른 층위의 정보로 나눠서 봐야 해요.
AI 크롤러 측정 전에 확인할 기준
AI 크롤러 측정을 시작할 때는 어떤 요청을 관측하고 무엇을 결론으로 삼을지 먼저 정하는 게 중요해요.
마케터는 페이지별 접근 여부와 반복 패턴을 보고, 사업자는 중요한 정보 페이지가 요청되는지 확인할 수 있어요. 개발자는 서버 로그 보존 기간, User-Agent 식별의 한계, 봇으로 분류되지 않는 요청 가능성을 함께 살펴야 해요.
| 확인 항목 | 점검 질문 |
|---|---|
| 측정 대상 | ChatGPT·Perplexity 등 어떤 AI 봇의 요청을 볼 것인가? |
| 페이지 범위 | 전체 페이지를 볼 것인가, 핵심 콘텐츠 URL을 우선 볼 것인가? |
| 판정 기준 | 요청 기록을 인용 결과와 혼동하지 않도록 구분했는가? |
| 데이터 보안 | 로그에 포함된 IP나 요청 정보의 보관 정책을 확인했는가? |
GeoAnalytics처럼 서버사이드 수집을 사용하는 접근은 태그 실행 여부와 관계없이 AI 봇 요청을 살펴보려는 목적에 맞아요. 그렇다고 측정 자체가 콘텐츠 품질이나 AI 노출을 대신 평가하는 것은 아니므로, 실제 답변 확인이나 출처 분석과 함께 해석해야 해요.
자주 묻는 질문
자주 나오는 질문은 태그 기반 분석의 한계, 서버 기록의 의미, 인용 보장 여부에 모여 있어요.
Q1. GA에 AI 봇 방문이 없으면 내 사이트를 가져가지 않은 건가요?
그렇게 단정하기 어려워요. AI 봇 대부분은 자바스크립트를 실행하지 않기 때문에 GA에 기록되지 않아도 서버에는 요청이 남을 수 있어요.
Q2. 서버 로그에 AI 봇 요청이 있으면 AI 답변에 인용되나요?
아니요. 요청 기록은 해당 페이지에 접근했다는 사실을 보여줄 뿐이고, AI 답변의 인용이나 노출을 보장하지 않아요.
Q3. AI 봇 트래픽 측정에서 페이지 단위 확인이 필요한 이유는 무엇인가요?
도메인 전체에 요청이 왔다는 사실만으로는 어떤 콘텐츠가 접근됐는지 알기 어렵기 때문이에요. 페이지 단위로 보면 핵심 문서가 실제 요청 대상이었는지 구분할 수 있어요.