Trainings-Crawler
GPTBot, ClaudeBot, Google-Extended, CCBot und andere sammeln Inhalte für künftige Modelle. Sie zu blockieren ist eine Lizenzentscheidung.
Kostenloses Tool von TK WebHosts
Können ChatGPT, Claude und Perplexity Ihre Website überhaupt lesen? Prüfen Sie, welche Such- und KI-Crawler Ihre robots.txt erlaubt — getrennt nach Trainings-Bots und den Live-Agenten, die entscheiden, ob KI-Antworten Sie zitieren.
| Crawler | Betreiber | Zugriff |
|---|
Fügen Sie dies Ihrer robots.txt hinzu, um die Antwort-Crawler zu öffnen (Trainings-Bots können blockiert bleiben):
GPTBot, ClaudeBot, Google-Extended, CCBot und andere sammeln Inhalte für künftige Modelle. Sie zu blockieren ist eine Lizenzentscheidung.
OAI-SearchBot, ChatGPT-User, Claude-SearchBot und PerplexityBot holen Ihre Seite, wenn ein Nutzer fragt — so zitieren KI-Assistenten Sie.
Googlebot und Bingbot bleiben das Fundament. Sie versehentlich zu blockieren ist fatal — dieser Check zeigt es sofort in Rot.
GPTBot sammelt Seiten fürs Training künftiger Modelle. ChatGPT-User und OAI-SearchBot holen und zitieren Ihre Seiten live. GPTBot zu blockieren betrifft nur das Training.
Nein. Trainings- und Antwort-Crawler sind getrennte User-Agents mit eigenen robots.txt-Regeln. Viele Verlage blockieren Training und bleiben zitierbar.
Ohne robots.txt ist jeder Crawler erlaubt — kein Fehler. Ernst ist ein Serverfehler der Datei: Google wertet ihn als „nicht crawlen“.
Es ist eine Konvention, kein Schloss. Die großen Betreiber halten sich öffentlich daran; einen Scraper, der Regeln ignoriert, stoppt es nicht.
Führen Sie den vollständigen SEO-Checker aus — zehn bewertete Kategorien, eine priorisierte To-do-Liste und ein teilbarer Bericht.
Kostenlosen SEO-Check starten