Jeder Bot, der über Ihre KI-Sichtbarkeit entscheidet
Ob ChatGPT, Claude, Perplexity oder Google Ihr Unternehmen lesen — und empfehlen — können, hängt an einer Handvoll Crawler. Was jeder tut, und ob Sie ihn hereinlassen sollten.
KI-Such-Crawler
OAI-SearchBot
Builds the index behind ChatGPT search — this is the bot that decides if ChatGPT can cite you.
PerplexityPerplexityBot
Indexes pages for Perplexity's answer engine — Perplexity cites sources on almost every answer.
AmazonAmazonbot
Feeds Alexa and Amazon's AI answers.
DuckDuckGoDuckAssistBot
Powers DuckDuckGo's AI-assisted answers.
KI-Abrufer auf Zuruf
KI-Trainings-Crawler
GPTBot
Collects pages to train ChatGPT's underlying models.
AnthropicClaudeBot
Crawls pages for Claude's models and search index.
GoogleGoogle-Extended
Controls whether Google may train Gemini on your content. Blocking it does NOT affect Google Search or AI Overviews.
Common CrawlCCBot
Builds a public web archive that many AI companies train models on. Blocking it quietly removes you from future models' knowledge.
ByteDanceBytespider
Trains ByteDance's models (Doubao).
AppleApplebot-Extended
Controls whether Apple may use your content for Apple Intelligence.
MetaMeta-ExternalAgent
Collects pages to train Meta's Llama models.
Such-Crawler
Welche davon erreichen Ihre Website tatsächlich? Der kostenlose SeeGeo-Audit prüft Ihre robots.txt gegen jeden Crawler auf dieser Seite — dazu Ihr CDN und das JavaScript-Rendering.
Kostenlosen Audit startenHäufige Fragen
Wie prüfe ich, ob KI-Crawler wie GPTBot meine Website lesen können?
Prüfen Sie zwei Dinge: dass Ihre robots.txt den Crawler nicht ausschließt, und dass Ihr Server oder CDN die Seite tatsächlich ausliefert, wenn eine Anfrage mit dem User-Agent dieses Crawlers eintrifft. Die zweite Prüfung zählt, weil Firewalls wie Cloudflare KI-Bots unabhängig von der robots.txt blockieren können. SeeGeos kostenloser Crawler-Check macht beides für GPTBot, OAI-SearchBot, ClaudeBot und PerplexityBot in wenigen Sekunden.
Welche KI-Crawler sollte ein kleines Unternehmen erlauben?
Erlauben Sie die Such-Crawler, die die Antworten speisen, die Kunden sehen — OAI-SearchBot und ChatGPT-User für ChatGPT, Googlebot für Googles AI Overviews, PerplexityBot und ClaudeBot — denn wer sie blockiert, verschwindet aus den Empfehlungen. Die reinen Trainings-Crawler (GPTBot, Google-Extended, CCBot) sind eine echte Abwägung: erlaubt, wissen künftige Modelle, dass es Sie gibt; blockiert, bleiben Ihre Inhalte aus den Trainingsdaten.
Reicht die robots.txt, um KI-Crawler zu steuern?
Nein. Die robots.txt ist eine Bitte, die sich wohlverhaltende Crawler befolgen, aber Ihr CDN oder Ihre Firewall kann einen Crawler blockieren, den die robots.txt erlaubt, und ein Crawler kann erlaubt sein, während Ihre Seiten nur mit JavaScript erscheinen, das er nie ausführt. Zugang ist erst real, wenn der Abruf gelingt und der Inhalt im HTML steht.