robots.txt für KI-Crawler: Solltest du GPTBot und ClaudeBot erlauben?

robots.txt ist eine kleine Textdatei, die Crawlern sagt, welche Teile deiner Website sie lesen dürfen. KI-Crawler beachten sie – diese eine Datei kann also entscheiden, ob ChatGPT, Claude und Perplexity deinen Inhalt überhaupt nutzen dürfen.

Was robots.txt macht

Sie liegt im Stammverzeichnis deiner Website (deineseite.de/robots.txt) und listet Regeln für jeden Crawler auf. Jeder Crawler weist sich mit einem „User-Agent”-Namen aus, und du kannst für jeden Pfade erlauben oder verbieten.

Die wichtigsten KI-Crawler

Erlauben oder blockieren?

Ein Beispiel zum Kopieren (KI willkommen heißen)

User-agent: *
Allow: /

User-agent: GPTBot
Allow: /

User-agent: ClaudeBot
Allow: /

User-agent: PerplexityBot
Allow: /

Sitemap: https://deineseite.de/sitemap.xml

Um stattdessen einen bestimmten Crawler zu blockieren, gib ihm einen eigenen Block:

User-agent: GPTBot
Disallow: /

Häufige Fehler

Fazit

robots.txt ist das Eingangstor und eine der vier Schichten unserer GEO-Einführung. Öffne deineseite.de/robots.txt, stell sicher, dass KI-Crawler nicht versehentlich blockiert sind, und füge eine Sitemap:-Zeile hinzu. Das dauert zwei Minuten und entscheidet, ob KI dich überhaupt lesen kann.

← Alle Leitfäden