GEO Robots.txt Checker

Verifique se seu robots.txt está pronto para Generative Engine Optimization. Veja instantaneamente quais bots de busca e treinamento de IA podem acessar seu site.

19 Bots de IA e Busca Suporte a Content-Signal Detecção de Sitemap Parser compatível com Google

Sempre buscamos robots.txt na raiz do site — o caminho que você cola é ignorado.

O que é Generative Engine Optimization (GEO)?

GEO é a prática de otimizar seu site para que ele possa ser descoberto, citado e mencionado por mecanismos de busca com IA e assistentes de chat — ChatGPT, Claude, Perplexity, Google AI Overviews, Meta AI e outros. O primeiro pré-requisito é que esses bots sejam permitidos pelo seu robots.txt.

Este verificador inspeciona 19 bots que importam para GEO — incluindo crawlers de treinamento IA (GPTBot, ClaudeBot, Google-Extended), crawlers de busca IA (OAI-SearchBot, PerplexityBot, Claude-SearchBot), buscadores acionados por usuário (ChatGPT-User, Claude-User) e crawlers de busca clássicos (Googlebot, Bingbot) — e mostra exatamente quais seu site permite.

Referência de Bots

Googlebot

Principal crawler de busca do Google — nunca bloqueie.

Google-Extended

Controla se o Google usa seu conteúdo para treinar Gemini / Bard.

GPTBot

Crawler da OpenAI usado para coletar conteúdo para treinamento de modelos GPT.

OAI-SearchBot

Crawler da OpenAI que alimenta os resultados de busca e citações do ChatGPT.

ChatGPT-User

Busca URLs sob demanda quando um usuário pede ao ChatGPT para visitar uma página.

ClaudeBot

Crawler da Anthropic usado para coletar conteúdo para treinamento do Claude.

Claude-SearchBot

Crawler da Anthropic para resultados de busca web do Claude.

Claude-User

Busca sob demanda quando um usuário do Claude compartilha ou solicita uma URL.

PerplexityBot

Crawler da Perplexity que alimenta seu motor de respostas IA.

Perplexity-User

Busca acionada por usuário dentro de conversas do Perplexity.

Meta-ExternalAgent

Crawler da Meta para Meta AI, treinamento do Llama e recursos de produtos.

Applebot-Extended

Controla se a Apple pode usar seu conteúdo para treinamento do Apple Intelligence.

Amazonbot

Crawler da Amazon usado para Alexa e outros recursos de IA.

Bytespider

Crawler da ByteDance / TikTok usado para treinar Doubao e modelos relacionados.

CCBot

Common Crawl — um dataset aberto usado por quase todo LLM em algum momento.

Perguntas Frequentes

Sobre Este GEO Robots.txt Checker

Este verificador foi criado especificamente para equipes de SEO e conteúdo que trabalham com Generative Engine Optimization. Em vez de ler manualmente um arquivo robots.txt e cruzar referências de nomes de bots, você obtém um veredito instantâneo, colorido, para os 19 crawlers que importam — incluindo os clássicos (Googlebot, Bingbot) e todo bot relevante de busca/treinamento IA da OpenAI, Anthropic, Google, Meta, Apple, Amazon, ByteDance, Perplexity e Common Crawl.

O parser segue a avaliação estilo Google do robots.txt: correspondência de user-agent baseada em substring, regra mais longa vence na avaliação de caminho e fallback wildcard para User-agent: *. Também detecta a diretiva emergente Content-Signal e lista cada referência Sitemap: declarada.