robots.txt-Generator — mit Presets für KI-Crawler (GPTBot)

Entwicklung

Ein robots.txt-Generator kombiniert eine Crawling-Richtlinie, Disallow-Pfade, den Speicherort des Sitemaps und die Auswahl zum Zulassen oder Blockieren von KI-Crawlern zu einer robots.txt-Datei, die bereit für das Stammverzeichnis deiner Website ist.

KI-gestützte Übersetzung in Prüfung

Diese Seite wurde mit KI-Unterstützung übersetzt und noch nicht professionell geprüft. Prüfen Sie die zitierten Quellen vor einer wichtigen Entscheidung.

Was ist das

robots.txt ist eine reine Textdatei im Stammverzeichnis der Website (/robots.txt), die gemäß dem Robots-Exclusion-Protokoll RFC 9309 die Allow- und Disallow-Regeln pro Crawler (User-agent) sowie den Speicherort des Sitemaps deklariert. Dieses Tool erstellt die Datei aus einer Basisrichtlinie und blockierten Pfaden und fügt Presets für bekannte KI-Crawler wie GPTBot, ClaudeBot, PerplexityBot und CCBot hinzu. Da die Einhaltung freiwillig ist, ist robots.txt kein Sicherheitsmechanismus.

robots.txt = wiederholte User-agent-Blöcke (Allow/Disallow-Regeln) + Sitemap: URL

Verwendung

  1. 1Wähle die Basisrichtlinie (alles zulassen oder alles blockieren) und liste die zu blockierenden Pfade auf.
  2. 2Wähle das Preset für KI-Crawler und füge die URL deines Sitemaps hinzu.
  3. 3Lade die erzeugte robots.txt herunter und lade sie in das Stammverzeichnis der Website hoch (/robots.txt).

Referenz

robots.txt-Generator — mit Presets für KI-Crawler (GPTBot) Referenz
CrawlerBetreiberZweck
GPTBotOpenAICrawling zum Training von KI-Modellen
ChatGPT-UserOpenAILive-Abrufe für ChatGPT-Nutzer
OAI-SearchBotOpenAISuchindex von ChatGPT
ClaudeBotAnthropicCrawling zum Training von KI-Modellen
Google-ExtendedGoogleSteuerungs-Token für das Gemini-Training
PerplexityBotPerplexityKI-Suchindex
CCBotCommon Crawloffenes Web-Archiv (für KI-Training wiederverwendet)
BytespiderByteDanceCrawling für KI-Training
Applebot-ExtendedAppleSteuerungs-Token für Apples KI-Training

Quellen und Normen

FAQ

Werden meine Regeln an einen Server gesendet?

Nein. Die robots.txt wird vollständig in deinem Browser erzeugt; nichts wird hochgeladen.

Stoppt das Blockieren von KI-Crawlern in der robots.txt sie vollständig?

Nein. robots.txt beruht auf freiwilliger Einhaltung (RFC 9309). Große KI-Crawler wie GPTBot geben an, sie zu befolgen, aber Bots, die die Regeln ignorieren, lassen sich nur auf Server- oder Firewall-Ebene stoppen.

Entfernt Disallow Seiten aus den Suchergebnissen?

Nein. Disallow verhindert nur das Crawling; bereits bekannte URLs können weiterhin indexiert werden. Verwende ein noindex-Meta-Tag, wenn das Ziel die Entfernung aus den Suchergebnissen ist.

Verwandte Tools