GEO Robots.txt Checker
Verifique se seu robots.txt está pronto para Generative Engine Optimization. Veja instantaneamente quais bots de busca e treinamento de IA podem acessar seu site.
O que é Generative Engine Optimization (GEO)?
GEO é a prática de otimizar seu site para que ele possa ser descoberto, citado e mencionado por mecanismos de busca com IA e assistentes de chat — ChatGPT, Claude, Perplexity, Google AI Overviews, Meta AI e outros. O primeiro pré-requisito é que esses bots sejam permitidos pelo seu robots.txt.
Este verificador inspeciona 19 bots que importam para GEO — incluindo crawlers de treinamento IA (GPTBot, ClaudeBot, Google-Extended), crawlers de busca IA (OAI-SearchBot, PerplexityBot, Claude-SearchBot), buscadores acionados por usuário (ChatGPT-User, Claude-User) e crawlers de busca clássicos (Googlebot, Bingbot) — e mostra exatamente quais seu site permite.
Referência de Bots
Principal crawler de busca do Google — nunca bloqueie.
Controla se o Google usa seu conteúdo para treinar Gemini / Bard.
Crawler da OpenAI usado para coletar conteúdo para treinamento de modelos GPT.
Crawler da OpenAI que alimenta os resultados de busca e citações do ChatGPT.
Busca URLs sob demanda quando um usuário pede ao ChatGPT para visitar uma página.
Crawler da Anthropic usado para coletar conteúdo para treinamento do Claude.
Crawler da Anthropic para resultados de busca web do Claude.
Busca sob demanda quando um usuário do Claude compartilha ou solicita uma URL.
Crawler da Perplexity que alimenta seu motor de respostas IA.
Busca acionada por usuário dentro de conversas do Perplexity.
Crawler da Meta para Meta AI, treinamento do Llama e recursos de produtos.
Controla se a Apple pode usar seu conteúdo para treinamento do Apple Intelligence.
Crawler da Amazon usado para Alexa e outros recursos de IA.
Crawler da ByteDance / TikTok usado para treinar Doubao e modelos relacionados.
Common Crawl — um dataset aberto usado por quase todo LLM em algum momento.
Perguntas Frequentes
Sobre Este GEO Robots.txt Checker
Este verificador foi criado especificamente para equipes de SEO e conteúdo que trabalham com Generative Engine Optimization. Em vez de ler manualmente um arquivo robots.txt e cruzar referências de nomes de bots, você obtém um veredito instantâneo, colorido, para os 19 crawlers que importam — incluindo os clássicos (Googlebot, Bingbot) e todo bot relevante de busca/treinamento IA da OpenAI, Anthropic, Google, Meta, Apple, Amazon, ByteDance, Perplexity e Common Crawl.
O parser segue a avaliação estilo Google do robots.txt: correspondência de user-agent baseada em substring, regra mais longa vence na avaliação de caminho e fallback wildcard para User-agent: *. Também detecta a diretiva emergente Content-Signal e lista cada referência Sitemap: declarada.