GEO Robots.txt Checker

Verifique se seu robots.txt está pronto para Generative Engine Optimization. Veja instantaneamente quais bots de busca e treinamento de IA podem acessar seu site.

19 Bots de IA e Busca Suporte a Content-Signal Detecção de Sitemap Parser compatível com Google

Sempre buscamos robots.txt na raiz do site — o caminho que você cola é ignorado.

O que é Generative Engine Optimization (GEO)?

GEO é a prática de otimizar seu site para que ele possa ser descoberto, citado e mencionado por mecanismos de busca com IA e assistentes de chat — ChatGPT, Claude, Perplexity, Google AI Overviews, Meta AI e outros. O primeiro pré-requisito é que esses bots sejam permitidos pelo seu robots.txt.

Este verificador inspeciona 19 bots que importam para GEO — incluindo crawlers de treinamento IA (GPTBot, ClaudeBot, Google-Extended), crawlers de busca IA (OAI-SearchBot, PerplexityBot, Claude-SearchBot), buscadores acionados por usuário (ChatGPT-User, Claude-User) e crawlers de busca clássicos (Googlebot, Bingbot) — e mostra exatamente quais seu site permite.

Referência de Bots

Googlebot

Principal crawler de busca do Google — nunca bloqueie.

Google-Extended

Controla se o Google usa seu conteúdo para treinar Gemini / Bard.

GPTBot

Rastreador OpenAI usado para coletar conteúdo para treinar modelos GPT.Crawler da OpenAI usado para coletar conteúdo para treinamento de modelos GPT.

OAI-SearchBot

Rastreador OpenAI que alimenta resultados de pesquisa e citações do ChatGPT.Crawler da OpenAI que alimenta os resultados de busca e citações do ChatGPT.

ChatGPT-User

Busca URLs sob demanda quando um usuário solicita ao ChatGPT para visitar uma página.Busca URLs sob demanda quando um usuário pede ao ChatGPT para visitar uma página.

ClaudeBot

Rastreador antrópico utilizado para coletar conteúdo para treinamento de Claude.Crawler da Anthropic usado para coletar conteúdo para treinamento do Claude.

Claude-SearchBot

Crawler da Anthropic para resultados de busca web do Claude.

Claude-User

Busca sob demanda quando um usuário Claude compartilha ou solicita um URL.Busca sob demanda quando um usuário do Claude compartilha ou solicita uma URL.

PerplexityBot

Crawler da Perplexity que alimenta seu motor de respostas IA.

Perplexity-User

Busca acionada por usuário dentro de conversas do Perplexity.

Meta-ExternalAgent

Crawler da Meta para Meta AI, treinamento do Llama e recursos de produtos.

Applebot-Extended

Controla se a Apple pode usar seu conteúdo para treinamento do Apple Intelligence.

Amazonbot

Crawler da Amazon usado para Alexa e outros recursos de IA.

Bytespider

Rastreador ByteDance / TikTok usado para treinar Doubao e modelos relacionados.Crawler da ByteDance / TikTok usado para treinar Doubao e modelos relacionados.

CCBot

Rastreamento comum – um conjunto de dados aberto usado por quase todos os LLM em algum momento.Common Crawl — um dataset aberto usado por quase todo LLM em algum momento.

Perguntas Frequentes

Sobre Este GEO Robots.txt Checker

Este verificador foi criado especificamente para equipes de SEO e conteúdo que trabalham com Generative Engine Optimization. Em vez de ler manualmente um arquivo robots.txt e cruzar referências de nomes de bots, você obtém um veredito instantâneo, colorido, para os 19 crawlers que importam — incluindo os clássicos (Googlebot, Bingbot) e todo bot relevante de busca/treinamento IA da OpenAI, Anthropic, Google, Meta, Apple, Amazon, ByteDance, Perplexity e Common Crawl.

O parser segue a avaliação estilo Google do robots.txt: correspondência de user-agent baseada em substring, regra mais longa vence na avaliação de caminho e fallback wildcard para User-agent: *. Também detecta a diretiva emergente Content-Signal e lista cada referência Sitemap: declarada.