GEO Robots.txt Checker

Verifica se il tuo robots.txt è pronto per Generative Engine Optimization. Vedi istantaneamente quali bot di ricerca e addestramento IA possono accedere al tuo sito.

19 Bot IA e Ricerca Supporto Content-Signal Rilevamento Sitemap Parser conforme a Google

Recuperiamo sempre robots.txt dalla radice del sito — il percorso incollato viene ignorato.

Cos'è Generative Engine Optimization (GEO)?

GEO è la pratica di ottimizzare il tuo sito web affinché possa essere scoperto, citato e menzionato dai motori di ricerca IA e assistenti chat — ChatGPT, Claude, Perplexity, Google AI Overviews, Meta AI e altri. Il primo prerequisito è che questi bot siano consentiti dal tuo robots.txt.

Questo checker ispeziona 19 bot che contano per il GEO — inclusi crawler di addestramento IA (GPTBot, ClaudeBot, Google-Extended), crawler di ricerca IA (OAI-SearchBot, PerplexityBot, Claude-SearchBot), recuperatori attivati dall'utente (ChatGPT-User, Claude-User) e crawler di ricerca classici (Googlebot, Bingbot) — e mostra esattamente quali il tuo sito consente.

Riferimento Bot

Googlebot

Principale crawler di ricerca Google — non bloccarlo mai.

Google-Extended

Controlla se Google utilizza i tuoi contenuti per addestrare Gemini / Bard.

GPTBot

Crawler OpenAI usato per raccogliere contenuti per addestrare i modelli GPT.

OAI-SearchBot

Crawler OpenAI che alimenta i risultati di ricerca e citazioni di ChatGPT.

ChatGPT-User

Recupera URL su richiesta quando un utente chiede a ChatGPT di visitare una pagina.

ClaudeBot

Crawler Anthropic usato per raccogliere contenuti per addestrare Claude.

Claude-SearchBot

Crawler Anthropic per i risultati di ricerca web di Claude.

Claude-User

Recupero su richiesta quando un utente Claude condivide o richiede un URL.

PerplexityBot

Crawler Perplexity che alimenta il loro motore di risposte IA.

Perplexity-User

Recupero attivato dall'utente all'interno delle conversazioni Perplexity.

Meta-ExternalAgent

Crawler Meta per Meta AI, addestramento Llama e funzionalità di prodotto.

Applebot-Extended

Controlla se Apple può usare i tuoi contenuti per addestrare Apple Intelligence.

Amazonbot

Crawler Amazon usato per Alexa e altre funzionalità IA.

Bytespider

Crawler ByteDance / TikTok usato per addestrare Doubao e modelli correlati.

CCBot

Common Crawl — un dataset aperto usato da quasi tutti gli LLM a un certo punto.

Domande Frequenti

Informazioni su Questo GEO Robots.txt Checker

Questo verificatore è stato creato specificamente per team SEO e di contenuto che lavorano su Generative Engine Optimization. Invece di leggere manualmente un file robots.txt e incrociare i nomi dei bot, ottieni un verdetto istantaneo con codice colore per i 19 crawler che contano — inclusi i classici (Googlebot, Bingbot) e ogni bot rilevante di ricerca/addestramento IA di OpenAI, Anthropic, Google, Meta, Apple, Amazon, ByteDance, Perplexity e Common Crawl.

Il parser segue la valutazione robots.txt in stile Google: corrispondenza user-agent basata su sottostringa, regola più lunga vince nella valutazione del percorso e fallback wildcard su User-agent: *. Rileva anche la direttiva emergente Content-Signal ed elenca ogni riferimento Sitemap: dichiarato.