OAI-SearchBotRobot OpenAI qui référence et relie les sites dans la recherche ChatGPT.
Indépendant de GPTBot : l’autoriser n’autorise pas l’entraînement.
POLITIQUE ROBOTS · MATRICE OFFICIELLE
Distinguez découverte par la recherche, entraînement des modèles et récupération à la demande. Seuls les groupes que la documentation actuelle déclare contrôlables sont générés.
Un préréglage remplit tous les tokens contrôlables ; chaque directive reste modifiable.
MATRICE DE CONTRÔLE
Seules les lignes « contrôlables » alimentent le brouillon. Les lignes informatives expliquent les requêtes utilisateur sans créer de fausses règles.
OAI-SearchBotRobot OpenAI qui référence et relie les sites dans la recherche ChatGPT.
Indépendant de GPTBot : l’autoriser n’autorise pas l’entraînement.
GPTBotRobot OpenAI pour des contenus susceptibles d’entraîner les modèles de fondation.
Le refus signale le traitement futur ; il est distinct de la présence dans la recherche ChatGPT.
ChatGPT-UserAgent OpenAI déclenché par l’utilisateur, et non robot d’exploration automatique.
OpenAI indique que robots.txt peut ne pas s’appliquer ; aucune règle n’est donc générée.
ClaudeBotRobot Anthropic pour des contenus pouvant contribuer à l’entraînement.
Anthropic indique actuellement que ses bots respectent robots.txt.
Claude-SearchBotRobot de recherche Anthropic destiné à améliorer la qualité des résultats.
Décision à séparer de l’accès d’entraînement ClaudeBot.
Claude-UserAgent Anthropic déclenché par une demande utilisateur.
Anthropic documente le contrôle robots.txt ; le bloquer peut réduire la récupération demandée.
Google-ExtendedToken de contrôle, pas un User-Agent HTTPToken Google contrôlant l’entraînement Gemini et le grounding avec Google Search.
Il n’a pas d’User-Agent HTTP propre et n’affecte ni inclusion ni classement Google Search.
PerplexityBotRobot de recherche Perplexity qui référence et relie les sites.
Perplexity précise qu’il ne sert pas à l’entraînement des modèles de fondation.
Perplexity-UserAgent Perplexity déclenché par l’utilisateur, sans rôle de crawl ou d’entraînement.
Perplexity indique qu’il ignore généralement robots.txt ; aucune règle n’est générée.
Informations vérifiées le · 2026-08-12
Consultez la documentation la plus récente avant déploiement : les produits et comportements peuvent évoluer après cette vérification.
Contrôles séparés pour OAI-SearchBot, GPTBot et le comportement de ChatGPT-User.
Ouvrir la source officielleConsignes robots pour ClaudeBot, Claude-SearchBot et Claude-User.
Ouvrir la source officielleDocumentation Google-Extended en tant que token de contrôle.
Ouvrir la source officielleRôles et comportement robots de PerplexityBot et Perplexity-User.
Ouvrir la source officielleLe texte généré est volontairement restreint : utilisez-le comme support de revue, pas comme fichier de remplacement.
Non. robots.txt exprime une préférence de crawl. Le réseau, les systèmes du fournisseur, la pertinence et le produit restent indépendants.
Leur documentation décrit des requêtes utilisateur auxquelles robots.txt peut ne pas s’appliquer ou est généralement ignoré. Une règle exagérerait le contrôle.
Non. Fusionnez uniquement les groupes validés, conservez les règles de recherche et de ressources, puis testez la réponse déployée.