Crawl Lab
Toutes les fiches crawlers

PerplexityBot : le crawler du moteur de réponses Perplexity

PerplexityBot est le robot d'indexation de Perplexity, le moteur de réponses IA. Sa documentation est explicite : il indexe le web pour faire apparaître les sites dans les résultats et les lier comme sources — pas pour collecter des données d'entraînement. Chaque réponse de Perplexity cite ses sources avec des liens cliquables : être crawlé par PerplexityBot est la condition d'entrée de ce canal de trafic.

Fiche technique

Opérateur
Perplexity
Rôle
Index de recherche Perplexity
Jeton robots.txt
PerplexityBot
User-agent (exemple)
Mozilla/5.0 (compatible; PerplexityBot/1.0; +https://perplexity.ai/perplexitybot)
Respecte robots.txt
Oui (documenté par Perplexity)
Plages IP officielles
8 plages publiées par l'opérateur, tous bots confondus (snapshot du 2026-07-23, rafraîchi à chaque déploiement)fichier officiel
Documentation officielle
Documentation des bots Perplexity

Perplexity, le moteur qui cite le plus

Perplexity s'est construit sur un principe : toute affirmation renvoie à une source visible. Ses réponses affichent systématiquement les liens des sites utilisés — un modèle plus généreux en trafic référent que la plupart des expériences IA concurrentes. Pour un éditeur de contenu, c'est l'un des écosystèmes IA les plus intéressants à cultiver.

La conséquence GEO est directe : un contenu précis, sourcé et structuré en réponses autonomes a des chances réelles d'être cité, même venant d'un site récent — Perplexity valorise la pertinence de la page plus que la notoriété du domaine.

PerplexityBot dans vos logs

Sa signature « PerplexityBot » apparaît dans le user-agent. Le volume de crawl est généralement raisonnable et ciblé sur le contenu. Perplexity opère aussi Perplexity-User, l'agent des consultations en direct déclenchées par les utilisateurs — deux signatures à suivre séparément dans vos logs.

Vérifier que c'est vraiment PerplexityBot

Perplexity publie ses plages d'IP officielles dans un fichier JSON dédié : tout hit « PerplexityBot » dont l'IP sort de ces plages est un imposteur. Notre analyseur de logs effectue cette vérification automatiquement, dans votre navigateur, et classe chaque hit en conséquence.

Consulter les plages IP officielles de PerplexityBot (JSON)

Bloquer ou autoriser PerplexityBot (robots.txt)

Sauf volonté d'exclusion totale des moteurs IA, laissez PerplexityBot accéder à votre site : le bloquer vous retire d'un moteur qui cite et lie généreusement ses sources. La documentation de Perplexity confirme le respect de robots.txt par ses crawlers.

Pour le bloquer :

User-agent: PerplexityBot
Disallow: /

Pour l'autoriser explicitement :

User-agent: PerplexityBot
Allow: /

Questions fréquentes

PerplexityBot sert-il à entraîner des modèles ?

Non, d'après la documentation officielle de Perplexity : PerplexityBot indexe le web pour faire apparaître et lier les sites dans les réponses du moteur, pas pour constituer des corpus d'entraînement. C'est un crawler de la famille « citation », comparable à OAI-SearchBot chez OpenAI.

Faut-il bloquer PerplexityBot ?

Pour un site qui cherche de la visibilité, non : Perplexity cite ses sources avec des liens cliquables dans chaque réponse — le bloquer supprime ce canal de trafic potentiel sans contrepartie. Le blocage ne se justifie que pour du contenu à exclure de tout moteur.

Comment vérifier un hit PerplexityBot ?

Par l'IP : Perplexity publie ses plages officielles dans perplexitybot.json. Une IP hors de ces plages = un faux PerplexityBot (souvent un scraper déguisé). Notre analyseur fait cette comparaison automatiquement sur chaque hit, sans que vos logs quittent votre navigateur.

Quelle différence entre PerplexityBot et Perplexity-User ?

PerplexityBot construit l'index du moteur en continu ; Perplexity-User consulte une page précise quand un utilisateur en a besoin dans sa session. Le premier est un crawl d'infrastructure, le second reflète une demande humaine en temps réel — deux user-agents distincts dans vos logs.

Sources

Chaque fait de cette fiche s'appuie sur une source primaire — la documentation officielle de l'opérateur et, quand elle existe, sa liste d'IP publiée.

Voyez ce que ce bot fait sur votre site

Glissez vos fichiers access.log dans l'analyseur de logs Crawl Lab : il isole PerplexityBot, vérifie son authenticité et liste les pages qu'il consulte — entièrement dans votre navigateur, sans upload.

Analyser mes logs

Autres fiches crawlers