Perplexity documente des agents capables d’explorer automatiquement le web ou d’accéder à une page à la demande d’un utilisateur. Les autoriser lève un obstacle technique. Cela ne permet pas de réserver une citation, de choisir le texte d’une réponse ni de prévoir la fréquence d’apparition d’un domaine.
Réponse en bref
Pour rendre un site accessible à la recherche Perplexity, autorisez PerplexityBot dans robots.txt si cette utilisation correspond à votre politique, puis vérifiez que le CDN et le pare-feu acceptent les requêtes provenant des plages IP publiées. Perplexity-User correspond à des accès déclenchés par les utilisateurs et se comporte différemment. Ensuite, publiez des pages précises, sourcées, identifiables et stables. Mesurez séparément les accès vérifiés, les liens observés, les visites et les conversions. Aucun réglage ne garantit une citation.
Les deux agents à distinguer
PerplexityBot
Perplexity décrit PerplexityBot comme l’agent destiné à faire remonter et relier des sites dans ses résultats de recherche. Il n’est pas présenté comme un robot d’entraînement des modèles fondamentaux. La documentation recommande de l’autoriser dans robots.txt et de permettre ses plages IP publiées lorsque l’éditeur souhaite apparaître dans Search.
Perplexity-User
Perplexity-User intervient lorsqu’une personne demande au produit de consulter une page pour répondre à sa question. La documentation indique que cet accès n’est ni un crawl automatique, ni une collecte pour l’entraînement d’un modèle fondamental. Comme la requête vient d’un utilisateur, cet agent peut ne pas appliquer robots.txt de la même manière qu’un crawler automatique.
Cette distinction est importante : une page privée ne doit jamais compter sur robots.txt pour empêcher un accès. Authentification, autorisation et contrôle serveur restent nécessaires.
Le cadre PACTE
| Étape | Question | Preuve attendue |
|---|---|---|
| P : Politique | quels usages du contenu sont acceptés ? | décision éditoriale écrite par type d’agent |
| A : Accès | l’agent choisi reçoit-il la bonne page ? | robots, HTTP, WAF, IP et logs cohérents |
| C : Contenu | la page résout-elle une question précise ? | réponse, exemple, source, limite |
| T : Traçabilité | sait-on identifier la page et son auteur ? | canonical, dates, attribution, historique |
| E : Évaluation | que mesure-t-on réellement ? | journal d’observations et analytics séparés |
PACTE n’est pas un score de Perplexity. C’est une grille pour éviter qu’un réglage réseau soit présenté comme une stratégie éditoriale complète.
P : Écrire la politique avant robots.txt
Décidez séparément :
- l’exploration automatique pour la recherche ;
- l’accès ponctuel déclenché par un utilisateur ;
- l’usage éventuel pour l’amélioration de modèles lorsqu’un fournisseur le propose ;
- les zones qui doivent rester privées.
Cette politique doit être compatible avec les contrats, licences, attentes des auteurs et obligations de confidentialité. Le présent guide ne remplace pas une analyse juridique.
Exemple technique à adapter
User-agent: PerplexityBot
Allow: /
User-agent: *
Disallow: /espace-prive/
Sitemap: https://www.exemple.fr/sitemap.xml
Le RFC 9309 précise que robots.txt n’est pas un mécanisme de sécurité. L’exemple exprime une préférence aux robots coopératifs ; il ne protège pas /espace-prive/.
A : Vérifier l’accès de bout en bout
Une règle Allow peut coexister avec un blocage réel. Contrôlez :
- le statut final après redirections ;
- l’absence de défi JavaScript obligatoire ;
- les règles du WAF et du CDN ;
- la présence du contenu utile dans le HTML reçu ;
- le canonical et les directives d’indexation ;
- les erreurs 403, 429 et 5xx dans les logs.
Un en-tête User-Agent peut être imité. Pour une exception de pare-feu ou une analyse de logs, confrontez-le aux fichiers IP officiels publiés par Perplexity. Ne copiez pas ces plages dans un article figé : utilisez la source actuelle, conservez la date de vérification et prévoyez un comportement prudent si la récupération échoue.
La documentation indique qu’un changement peut demander jusqu’à vingt-quatre heures pour être reflété. Ce délai concerne la prise en compte du réglage, pas l’obtention d’une citation.
C : Publier une ressource que l’on peut attribuer
Une page utile à une recherche de réponse remplit généralement quatre fonctions :
- elle répond directement à une question définie ;
- elle explique comment la réponse a été obtenue ;
- elle relie les faits importants à leurs sources ;
- elle annonce les conditions qui pourraient modifier la conclusion.
Évitez les articles construits uniquement à partir d’autres synthèses. Apportez une grille, un test, des données, un exemple complet ou une expérience documentée. Une page distinctive n’a pas besoin d’affirmer que son auteur est une autorité : elle montre son travail.
Exemple de passage attribuable
Faible : « Les assistants préfèrent les contenus structurés et récents. »
Contrôlable : « Le 13 juillet 2026, la documentation Perplexity distingue PerplexityBot, destiné à Search, de Perplexity-User, utilisé pour certaines requêtes déclenchées par les utilisateurs. »
Le second passage définit une source, une date et une portée. Il devra être revu si la documentation change.
T : Construire la traçabilité
Pour chaque article, vérifiez :
- une URL canonique stable ;
- un auteur visible et relié à une page de profil ;
- une date de publication et une date de mise à jour qui reflètent des actions réelles ;
- un historique des corrections importantes ;
- des sources accessibles ;
- des profils externes uniquement lorsqu’ils sont détenus et validés.
Les données structurées peuvent reproduire ces informations, mais elles ne doivent jamais les inventer. La cohérence entre page, métadonnées et profils est plus importante que la quantité de propriétés.
E : Évaluer sans faux classement
Un protocole simple peut suivre quatre couches :
| Couche | Observation | Conclusion autorisée |
|---|---|---|
| accès | requête PerplexityBot avec IP vérifiée | une ressource a été demandée |
| présence | domaine ou URL visible dans une réponse datée | présence observée dans ces conditions |
| visite | session attribuable dans les analytics | un clic a atteint le site |
| effet | formulaire ou autre action après la visite | une action a été enregistrée dans le parcours |
Ne transformez pas dix requêtes en « part de voix » universelle. Fixez avant le test la langue, le pays, les formulations, le mode utilisé et la période. Conservez aussi les absences.
Diagnostic en cas d’absence
- PerplexityBot est refusé : modifier la politique uniquement si l’éditeur souhaite l’accès.
- Le bot est autorisé mais reçoit une erreur : corriger WAF, limitation, redirection ou rendu.
- La page est accessible mais générique : renforcer la réponse et l’apport original.
- La page est solide mais jamais observée : élargir prudemment le protocole, puis documenter l’absence.
- Un lien est observé sans visite : ne pas conclure à une erreur ; exposition et clic sont deux événements distincts.
Limites
Perplexity ne publie pas une formule de sélection ou de classement permettant de prévoir ses citations. Ses agents, plages IP, interfaces et comportements peuvent évoluer. Les réponses varient selon la question et le contexte. Le cadre PACTE améliore la qualité du diagnostic ; il ne certifie ni indexation, ni présence, ni attribution.
Articles liés
- Robots et crawlers IA : décider qui peut explorer quoi
- Guide GEO : rendre un contenu utile aux moteurs de réponse
- Mesurer sa visibilité dans les moteurs de réponse
Prochaine étape
Écrivez votre politique d’accès, vérifiez un passage réel de PerplexityBot dans les logs, puis auditez une seule page avec PACTE. Pour obtenir un cadre de revue, décrire le site et la page prioritaire.
Sources vérifiées
- Source externe, docs.perplexity.ai , consultée le 13 juillet 2026
- Source externe, perplexity.com , consultée le 13 juillet 2026
- Source externe, perplexity.com , consultée le 13 juillet 2026
- Source externe, rfc-editor.org , consultée le 13 juillet 2026
- Source externe, developers.google.com , consultée le 13 juillet 2026