GEO Robots.txt Checker

Prüfen Sie, ob Ihre robots.txt für Generative Engine Optimization bereit ist. Sehen Sie sofort, welche KI-Such- und Trainings-Bots auf Ihre Website zugreifen können.

19 KI- und Such-Bots Content-Signal-Unterstützung Sitemap-Erkennung Google-konformer Parser

Wir rufen robots.txt immer vom Site-Root ab — der eingefügte Pfad wird ignoriert.

Was ist Generative Engine Optimization (GEO)?

GEO ist die Praxis, Ihre Website so zu optimieren, dass sie von KI-gestützten Suchmaschinen und Chat-Assistenten — ChatGPT, Claude, Perplexity, Google AI Overviews, Meta AI und mehr — gefunden, zitiert und erwähnt werden kann. Die erste Voraussetzung ist, dass diese Bots von Ihrer robots.txt erlaubt sein müssen.

Dieser Checker prüft 19 Bots, die für GEO wichtig sind — einschließlich KI-Trainings-Crawler (GPTBot, ClaudeBot, Google-Extended), KI-Such-Crawler (OAI-SearchBot, PerplexityBot, Claude-SearchBot), benutzergesteuerte Fetcher (ChatGPT-User, Claude-User) und klassische Such-Crawler (Googlebot, Bingbot) — und zeigt genau, welche Ihre Website erlaubt.

Bot-Referenz

Googlebot

Haupt-Suchcrawler von Google — niemals blockieren.

Google-Extended

Steuert, ob Google Ihre Inhalte zum Trainieren von Gemini / Bard verwendet.

GPTBot

OpenAI-Crawler zum Sammeln von Inhalten für das Training von GPT-Modellen.

OAI-SearchBot

OpenAI-Crawler, der die ChatGPT-Suchergebnisse und -Zitate speist.

ChatGPT-User

Ruft URLs bei Bedarf ab, wenn ein Nutzer ChatGPT bittet, eine Seite zu besuchen.

ClaudeBot

Anthropic-Crawler zum Sammeln von Inhalten für das Training von Claude.

Claude-SearchBot

Anthropic-Crawler für Claude-Websuchergebnisse.

Claude-User

On-Demand-Abruf, wenn ein Claude-Nutzer eine URL teilt oder anfordert.

PerplexityBot

Perplexity-Crawler, der ihre KI-Antwort-Engine speist.

Perplexity-User

Nutzergesteuerter Abruf innerhalb von Perplexity-Konversationen.

Meta-ExternalAgent

Meta-Crawler für Meta AI, Llama-Training und Produktfunktionen.

Applebot-Extended

Steuert, ob Apple Ihre Inhalte für das Training von Apple Intelligence verwenden darf.

Amazonbot

Amazon-Crawler für Alexa und andere KI-Funktionen.

Bytespider

ByteDance / TikTok-Crawler zum Trainieren von Doubao und verwandten Modellen.

CCBot

Common Crawl — ein offener Datensatz, der von fast jedem LLM irgendwann verwendet wird.

Häufig gestellte Fragen

Über diesen GEO Robots.txt Checker

Dieser Checker wurde speziell für SEO- und Content-Teams entwickelt, die an Generative Engine Optimization arbeiten. Statt eine robots.txt-Datei manuell zu lesen und Bot-Namen abzugleichen, erhalten Sie ein sofortiges, farbcodiertes Urteil für die 19 wichtigen Crawler — einschließlich der Klassiker (Googlebot, Bingbot) und aller relevanten KI-Such-/Trainings-Bots von OpenAI, Anthropic, Google, Meta, Apple, Amazon, ByteDance, Perplexity und Common Crawl.

Der Parser folgt der Google-Stil-robots.txt-Auswertung: substring-basierte User-Agent-Übereinstimmung, längste-Regel-gewinnt bei der Pfadauswertung und Wildcard-Fallback auf User-agent: *. Er erkennt außerdem die aufkommende Content-Signal-Direktive und listet jede deklarierte Sitemap:-Referenz auf.