GEO Robots.txt Checker
Prüfen Sie, ob Ihre robots.txt für Generative Engine Optimization bereit ist. Sehen Sie sofort, welche KI-Such- und Trainings-Bots auf Ihre Website zugreifen können.
Was ist Generative Engine Optimization (GEO)?
GEO ist die Praxis, Ihre Website so zu optimieren, dass sie von KI-gestützten Suchmaschinen und Chat-Assistenten — ChatGPT, Claude, Perplexity, Google AI Overviews, Meta AI und mehr — gefunden, zitiert und erwähnt werden kann. Die erste Voraussetzung ist, dass diese Bots von Ihrer robots.txt erlaubt sein müssen.
Dieser Checker prüft 19 Bots, die für GEO wichtig sind — einschließlich KI-Trainings-Crawler (GPTBot, ClaudeBot, Google-Extended), KI-Such-Crawler (OAI-SearchBot, PerplexityBot, Claude-SearchBot), benutzergesteuerte Fetcher (ChatGPT-User, Claude-User) und klassische Such-Crawler (Googlebot, Bingbot) — und zeigt genau, welche Ihre Website erlaubt.
Bot-Referenz
Haupt-Suchcrawler von Google — niemals blockieren.
Steuert, ob Google Ihre Inhalte zum Trainieren von Gemini / Bard verwendet.
OpenAI-Crawler zum Sammeln von Inhalten für das Training von GPT-Modellen.
OpenAI-Crawler, der die ChatGPT-Suchergebnisse und -Zitate speist.
Ruft URLs bei Bedarf ab, wenn ein Nutzer ChatGPT bittet, eine Seite zu besuchen.
Anthropic-Crawler zum Sammeln von Inhalten für das Training von Claude.
Anthropic-Crawler für Claude-Websuchergebnisse.
On-Demand-Abruf, wenn ein Claude-Nutzer eine URL teilt oder anfordert.
Perplexity-Crawler, der ihre KI-Antwort-Engine speist.
Nutzergesteuerter Abruf innerhalb von Perplexity-Konversationen.
Meta-Crawler für Meta AI, Llama-Training und Produktfunktionen.
Steuert, ob Apple Ihre Inhalte für das Training von Apple Intelligence verwenden darf.
Amazon-Crawler für Alexa und andere KI-Funktionen.
ByteDance / TikTok-Crawler zum Trainieren von Doubao und verwandten Modellen.
Common Crawl — ein offener Datensatz, der von fast jedem LLM irgendwann verwendet wird.
Häufig gestellte Fragen
Über diesen GEO Robots.txt Checker
Dieser Checker wurde speziell für SEO- und Content-Teams entwickelt, die an Generative Engine Optimization arbeiten. Statt eine robots.txt-Datei manuell zu lesen und Bot-Namen abzugleichen, erhalten Sie ein sofortiges, farbcodiertes Urteil für die 19 wichtigen Crawler — einschließlich der Klassiker (Googlebot, Bingbot) und aller relevanten KI-Such-/Trainings-Bots von OpenAI, Anthropic, Google, Meta, Apple, Amazon, ByteDance, Perplexity und Common Crawl.
Der Parser folgt der Google-Stil-robots.txt-Auswertung: substring-basierte User-Agent-Übereinstimmung, längste-Regel-gewinnt bei der Pfadauswertung und Wildcard-Fallback auf User-agent: *. Er erkennt außerdem die aufkommende Content-Signal-Direktive und listet jede deklarierte Sitemap:-Referenz auf.