모든 무료 도구

무료 robots.txt AI 봇 체커: 어떤 AI 크롤러가 내 사이트에 도달하는지 확인하세요

도메인이나 robots.txt URL을 붙여넣으세요. 파일을 읽고 모든 주요 AI 크롤러를 내 Allow 및 Disallow 규칙과 대조하여, 어떤 봇이 내 사이트에 도달하는지 봇별로 알려 드립니다. 가입이 필요 없습니다.

무료, 가입 불필요. 내 robots.txt를 읽고 GPTBot, ClaudeBot, Google-Extended, PerplexityBot 등 어떤 AI 크롤러를 현재 허용하거나 차단하고 있는지 보여 줍니다.

AI 봇 체커가 검증하는 항목

  • 모든 주요 AI user-agent에 대한 봇별 판정(허용, 부분 허용, 차단)
  • 학습 크롤러: GPTBot, ClaudeBot, Google-Extended, CCBot, Bytespider, Meta-ExternalAgent
  • 검색 크롤러: OAI-SearchBot, Claude-SearchBot, PerplexityBot, Applebot-Extended
  • 주문형 가져오기 봇: ChatGPT-User, Claude-User, Perplexity-User
  • robots.txt의 URL 위치와 HTTP 상태 코드
  • User-agent: * 와 봇별 규칙 사이의 충돌
  • 봇별 Disallow 경로 — 차단된 것뿐 아니라 숨겨진 것까지 확인할 수 있습니다

내 robots.txt가 예전보다 더 중요해진 이유

robots.txt는 크롤러가 가장 먼저 읽는 파일이며, 이제 AI 기업들은 서로 다른 user-agent를 가진 여러 크롤러를 운영합니다. OpenAI만 해도 세 가지가 있습니다. 학습용 GPTBot, ChatGPT Search용 OAI-SearchBot, 주문형 가져오기용 ChatGPT-User입니다. Anthropic, Google, Perplexity, Common Crawl, Meta도 각자 고유한 봇을 가지고 있습니다.

이 파일에서 내리는 결정은 서로 다른 두 가지 결과를 만듭니다. 검색 크롤러를 차단하면 브랜드가 ChatGPT, Claude, Perplexity 답변에서 사라집니다. 옵트아웃하려 했는데 학습 크롤러를 열어 두면, 내일의 모델이 내 콘텐츠로 무료로 학습하게 됩니다.

대부분의 사이트는 결국 한쪽은 원하고 다른 한쪽은 원하지 않게 됩니다.

AI 봇 차단에 관해 데이터가 말하는 것

규칙을 작성하기 전에 알아 둘 만한 세 가지 수치.

Rutgers Business School과 Wharton의 연구(2026년 1월)는 robots.txt로 AI 크롤러를 차단한 퍼블리셔를 추적했고, 총 트래픽이 평균 23% 감소했다는 사실을 발견했습니다. 차단은 봇만 막는 것이 아니라 AI가 유도한 클릭까지 끊어 버립니다.
주요 뉴스 사이트 100곳을 대상으로 한 BuzzStream의 감사에서는 79%가 적어도 하나의 AI 학습 봇을 차단하고 있었습니다 — 합리적인 선택입니다 — 하지만 71%는 대개 실수로 검색이나 가져오기 봇도 적어도 하나 차단하고 있었습니다. 포괄적인 Disallow: / 가 모든 것을 걸어 버린 것입니다.
Cloudflare 자체 데이터에 따르면 2024년 7월 이후 100만 명이 넘는 고객이 원클릭 “Block AI Scrapers” 토글을 활성화했습니다. 2025년 7월 1일 이후로는 Cloudflare의 모든 신규 도메인이 기본적으로 AI 봇을 차단한 상태로 제공됩니다. robots.txt에 Allow라고 되어 있는데도 봇이 도달하지 못한다면, 대개 이것이 원인입니다.

결과를 읽는 방법

허용

크롤러가 사이트 루트에 접근할 수 있습니다. OAI-SearchBot, Claude-SearchBot, PerplexityBot 같은 검색 봇의 경우, 이것이 AI 답변에서 인용될 자격을 유지해 줍니다.

부분 허용

크롤러가 사이트에는 접근할 수 있지만 특정 경로가 Disallow되어 있습니다. 보통은 문제없지만, AI 검색에 노출하고 싶은 페이지를 숨기고 있지 않은지 확인할 가치가 있습니다.

차단

Disallow: / 규칙이 이 크롤러를 완전히 막고 있습니다. 학습 옵트아웃이라면 의도된 것이지만, 노출을 유지하고 싶었던 검색 크롤러라면 문제입니다.

가장 흔한 robots.txt 실수 (그리고 해결 방법)

실수로 AI 검색을 차단하는 경우.

OAI-SearchBot, Claude-SearchBot 또는 PerplexityBot까지 걸리는 포괄적인 Disallow는 알게 모르게 당신을 AI 답변에서 제외시킵니다.

해결: 검색 크롤러를 각자 고유한 User-agent 그룹에 나열하고 명시적으로 허용하세요.

User-agent: * 로 AI를 차단하는 경우.

그 그룹은 Googlebot, Bingbot을 비롯한 모든 일반 검색 크롤러까지 걸어 버려, 의도한 것보다 훨씬 많은 것을 차단합니다.

해결: 각 AI user-agent를 고유한 그룹에 명시하고 와일드카드는 건드리지 마세요.

Google-Extended와 Googlebot을 혼동하는 경우.

잘못된 쪽을 차단하면 AI 학습이 켜진 채로 남거나, 실수로 Google Search 색인에서 자신을 제외시키게 됩니다.

해결: Google-Extended는 Gemini와 Vertex AI 학습에서 옵트아웃하는 데 사용하고, Googlebot은 오가닉 검색을 위해 그대로 두세요.

robots.txt를 방화벽처럼 여기는 경우.

이것은 권고 사항일 뿐입니다. 행동이 올바른 크롤러는 이를 존중하지만, 악의적인 행위자와 제3자 스크래퍼는 무시합니다.

해결: 반드시 완전히 차단해야 하는 봇에는 서버 측 차단(Cloudflare AI 규칙, WAF, .htaccess)을 추가하세요.

Cloudflare가 내 Allow 규칙을 덮어쓰는 경우.

2025년 7월 이후 Cloudflare는 신규 도메인에서 robots.txt에 무엇이 적혀 있든 기본적으로 AI 봇을 차단합니다.

해결: Cloudflare 대시보드를 열고 Security → Bots → AI Scrapers and Crawlers 로 이동한 뒤, AI 검색 봇이 사이트에 도달하기를 원한다면 꺼 두세요.

AI가 실제로 당신을 인용하고 있는지 확인하고 싶으신가요?

robots.txt 감사는 어떤 AI 크롤러가 내 사이트에 도달할 수 있는지 알려 줍니다. SEOcrawl AI의 AI Tracker는 그들이 도달한 뒤 무엇을 하는지 알려 줍니다. ChatGPT, Claude, Gemini, Perplexity가 얼마나 자주 내 브랜드를 언급하고 인용하는지, 어떤 프롬프트가 나를 등장시키는지, 그리고 내가 모니터링하기로 선택한 경쟁사와 비교해 어떤지를 — 이 모든 것을 같은 대시보드에서 Google Search Console 데이터와 함께 확인할 수 있습니다.

자주 묻는 질문

AI 봇 체커란 무엇인가요?

robots.txt를 읽고 어떤 AI 크롤러를 허용하거나 차단하고 있는지 한 번에 한 봇씩 알려 주는 도구입니다. 내 Allow 및 Disallow 규칙을 주요 AI 기업의 user-agent 토큰과 대조합니다. OpenAI(GPTBot, OAI-SearchBot, ChatGPT-User), Anthropic(ClaudeBot, Claude-SearchBot, Claude-User), Google(Google-Extended), Perplexity(PerplexityBot), Meta, Common Crawl 등이 대상입니다.

GPTBot이란 무엇인가요?

GPTBot은 OpenAI의 웹 크롤러로, 2023년 8월에 출시되었으며 향후 GPT 모델을 학습시키기 위해 공개적으로 이용 가능한 콘텐츠를 수집하는 데 사용됩니다. ChatGPT Search를 구동하는 OAI-SearchBot이나, 누군가 어시스턴트에게 페이지를 읽어 달라고 요청할 때 해당 페이지를 가져오는 ChatGPT-User와는 다른 봇입니다. 세 봇 모두 각자 독립적으로 robots.txt를 따르므로, 하나는 허용하고 다른 하나는 차단할 수 있습니다.

학습용, 검색용, 주문형 가져오기 AI 봇의 차이는 무엇인가요?

학습 봇(GPTBot, CCBot, Google-Extended, Bytespider)은 기반 모델을 학습시키기 위해 콘텐츠를 스크래핑합니다. 검색 봇(OAI-SearchBot, Claude-SearchBot, PerplexityBot)은 AI 검색 답변에서 인용될 수 있도록 사이트를 색인합니다. 주문형 가져오기 봇(ChatGPT-User, Claude-User, Perplexity-User)은 사용자가 어시스턴트에게 해당 페이지에 대해 물을 때 실시간으로 한 페이지를 가져옵니다. 각각은 robots.txt에서 개별적으로 제어할 수 있습니다.

robots.txt에서 AI 크롤러를 어떻게 차단하나요?

크롤러마다 그룹을 하나씩 추가하고 Disallow 규칙을 작성합니다. 예를 들어 "User-agent: GPTBot" 다음 줄에 "Disallow: /"를 씁니다. 여러 개를 차단하려면 각 user-agent를 별도 그룹에 나열하세요. robots.txt는 권고 사항이라는 점을 기억하세요. GPTBot이나 ClaudeBot 같은 행동이 올바른 크롤러는 이를 따르지만, 무시하기로 한 봇은 막지 못합니다.

AI 봇을 차단해야 하나요, 허용해야 하나요?

목표에 따라 다릅니다. 브랜드가 AI 답변에서 인용될 수 있도록 검색 봇(OAI-SearchBot, Claude-SearchBot, PerplexityBot)은 허용하세요. 학습 봇(GPTBot, CCBot, Google-Extended, Bytespider)은 옵트아웃할 특별한 이유가 있을 때만 차단하세요. Rutgers/Wharton 연구에 따르면 AI 크롤러를 전면 차단한 퍼블리셔는 총 트래픽의 23%를 잃었으며, 따라서 일괄 금지는 좀처럼 이득이 되지 않습니다.

ClaudeBot은 robots.txt를 존중하나요?

네. Anthropic의 공식 문서는 ClaudeBot, Claude-User, Claude-SearchBot 모두가 표준 외 Crawl-delay 확장을 포함한 표준 robots.txt 지시문을 따른다는 사실을 확인해 줍니다. 각 user-agent를 독립적으로 허용하거나 차단할 수 있으므로, Claude의 검색 답변에서 계속 인용되면서도 학습에서는 옵트아웃할 수 있습니다.

Google-Extended를 차단하면 Google 순위에 영향이 있나요?

아니요. Google-Extended는 내 콘텐츠가 Gemini와 Vertex AI를 학습하고 근거로 삼는 데 사용되는지만 제어합니다. Googlebot과는 별개의 토큰이므로 Google-Extended를 차단해도 Google 검색에서의 순위에는 아무 영향이 없습니다. 자연 검색을 건드리지 않고 AI 학습에서 옵트아웃하는 깔끔한 방법입니다.

Cloudflare의 기본 AI 봇 차단이 내 robots.txt의 Allow 규칙을 덮어쓰나요?

네, 네트워크 수준 차단이 우선합니다. 2025년 7월 1일 이후 Cloudflare는 "AI Scrapers and Crawlers" 관리형 규칙을 통해, 내 robots.txt가 Allow라고 되어 있어도 모든 신규 도메인에서 AI 봇을 기본적으로 차단합니다. 이 체커에서는 Allowed로 표시되지만 실제로는 페이지를 가져오지 못하는 봇이 있다면 Cloudflare의 Security → Bots 설정을 확인하세요.