Liste des robots d'IA : GPTBot, ClaudeBot, PerplexityBot et comment les autoriser
Les entreprises d’IA lisent le web avec des robots nommés (chacun a un nom de « user-agent »). Les connaître vous permet un choix délibéré : autorisez ceux par qui vous voulez être cité, et bloquez ceux que vous ne voulez pas. Voici les principaux à ce jour.
Les principaux robots d’IA
- GPTBot (OpenAI) — le robot général d’OpenAI, utilisé pour rassembler du contenu pour ses modèles.
- OAI-SearchBot (OpenAI) — récupère des pages pour les afficher et les lier dans les résultats de recherche de ChatGPT.
- ChatGPT-User (OpenAI) — récupère une page à la demande quand un utilisateur demande à ChatGPT de visiter un lien précis.
- ClaudeBot (Anthropic) — le robot d’Anthropic pour Claude.
- PerplexityBot (Perplexity) — explore les pages pour que Perplexity puisse y répondre et les citer.
- Google-Extended (Google) — pas un robot distinct, mais un jeton
robots.txtqui contrôle si votre contenu sert à l’IA générative de Google (Gemini). L’exploration normale reste assurée par Googlebot.
Le Copilot de Microsoft s’appuie largement sur l’index de Bing, donc le Bingbot standard compte aussi là.
Comment les autoriser (robots.txt)
Si vous voulez être lisible et citable, la règle la plus simple est de tout autoriser (le comportement par défaut si vous n’avez pas de robots.txt). Pour être explicite :
User-agent: GPTBot
Allow: /
User-agent: OAI-SearchBot
Allow: /
User-agent: ClaudeBot
Allow: /
User-agent: PerplexityBot
Allow: /
Comment en bloquer un
Si vous préférez qu’un robot précis n’utilise pas votre contenu, interdisez-le par son nom :
User-agent: GPTBot
Disallow: /
Pour l’usage en IA générative de Google en particulier, ajoutez le jeton (cela n’affecte pas la recherche Google classique) :
User-agent: Google-Extended
Disallow: /
Bloquer les robots d’entraînement est un choix légitime — mais sachez que cela peut aussi réduire la fréquence à laquelle l’IA de cette entreprise vous lit et vous cite. Décidez robot par robot.
Une mise en garde : les noms changent
Les robots d’IA sont récents, et leurs noms et comportements évoluent. Prenez ceci comme un point de départ et consultez la documentation officielle de chaque entreprise pour le user-agent et les règles actuels. Une faute de frappe dans le robots.txt — comme interdire / à tout le monde par mégarde — peut vous rendre invisible, alors vérifiez après modification.
En résumé
Connaissez les robots, puis choisissez délibérément : autorisez les IA dans lesquelles vous voulez être trouvé, bloquez celles que vous ne voulez pas, et revérifiez votre robots.txt. Pour le fonctionnement complet de robots.txt, voyez robots.txt pour les robots d’IA, ou l’introduction au GEO pour la vue d’ensemble.
Essayez notre outil gratuit : Générateur de robots.txt et llms.txt →