Être cité par ChatGPT : la checklist qu'un agent SEO applique
Ce qui rend un site citable par ChatGPT et Perplexity : des réponses qui se lisent seules, des chiffres sourcés, et un robots.txt qui laisse entrer les bons robots.

#Être cité par ChatGPT se vérifie en quatre points, dans cet ordre
Un modèle génératif ne cite pas un site parce qu'il est ancien ou bien écrit : il reprend le passage qui répond le plus vite, avec le chiffre le plus vérifiable, dans le format le plus facile à extraire. Quatre points comptent, dans cet ordre : une réponse posée dans les premiers mots, des chiffres sourcés plutôt que des adjectifs, un robots.txt qui laisse entrer les bons robots, et une présence sur les pages tierces que le modèle lit en dehors du site.
La requête « être cité par ChatGPT » rassemble 200 recherches par mois en France, selon le relevé DataForSEO qu'on tient à jour sur les sujets du carnet éditorial. Un volume modeste, mais une question que tout dirigeant qui a déjà tapé le nom de son entreprise dans ChatGPT se pose au moins une fois.
#La réponse doit arriver avant que le modèle continue de chercher
Un modèle construit sa réponse à partir des passages qui répondent le plus directement à la question posée, pas à partir de la page qui se lit le mieux pour un humain. Une page qui ouvre sur une définition, un chiffre ou une réponse en une phrase donne un passage prêt à reprendre. Une page qui ouvre sur une présentation de l'entreprise ou une promesse commerciale n'offre rien à extraire avant plusieurs paragraphes.
Selon l'étude « GEO: Generative Engine Optimization », menée par des chercheurs de l'université de Princeton et publiée sur arXiv, ajouter des statistiques vérifiables à une page améliore de 37 % son impression de fiabilité auprès des moteurs génératifs testés. Ajouter des citations sourcées améliore la visibilité positionnée de 22 %. Le bourrage de mots-clés, à l'inverse, fait reculer une page de 10 % sous la version non optimisée.
#Un chiffre sourcé pèse plus qu'une affirmation, à condition d'être vérifiable
Le modèle recoupe ce qu'il lit avec plusieurs sources avant de citer un chiffre. Une page qui avance un pourcentage sans nommer son origine perd ce recoupement face à une page concurrente qui cite l'organisme, l'étude ou la période mesurée. La règle vaut pour ChatGPT comme pour un lecteur humain : un chiffre sans source ne convainc personne.
La même étude relève que la lisibilité d'un texte, phrases courtes et mots simples, pèse 15 à 30 % dans la visibilité gagnée, un gain presque aussi net que l'ajout de statistiques. Une page progresse donc parfois sans ajouter une ligne, en réécrivant simplement ce qu'elle a déjà.
#Le robots.txt doit nommer les robots qui lisent pour ChatGPT et Perplexity
3 robots distincts travaillent pour OpenAI : GPTBot lit les pages qui serviront à entraîner les futurs modèles, OAI-SearchBot indexe les pages que ChatGPT peut citer en réponse à une recherche, et ChatGPT-User va chercher une page en direct pendant une conversation. Les bloquer tous ensemble, comme le fait un site prudent avec un robot inconnu, retire toute chance d'être cité. Le robots.txt fait aussi partie des points vérifiés dans l'audit SEO technique.
Perplexity fonctionne sur le même principe, avec PerplexityBot pour l'index et Perplexity-User pour les requêtes en direct, documentés sur la page officielle des robots Perplexity. Perplexity-User se présente comme un agent qui répond à une demande précise d'un utilisateur, pas comme un robot d'indexation classique, une distinction que l'entreprise assume face aux éditeurs qui voudraient le bloquer.
#La présence hors du site compte autant que le contenu du site
Un modèle ne lit pas seulement le site d'une entreprise : il lit aussi les avis, les annuaires professionnels, les articles qui la citent, les réponses postées sur des forums spécialisés. Une entreprise absente de ces pages tierces reste invisible même avec un site bien structuré, parce que le modèle recoupe plusieurs sources avant de nommer une marque en réponse à une question d'achat.
C'est le principe du netlinking classique, appliqué à un lecteur qui lit tout d'un coup plutôt que de suivre des liens un par un. Le cadre complet est posé dans le guide sur la différence entre SEO, GEO et AEO.
#Le panel qu'on interroge chaque mois pour savoir si ça marche
On pose quinze questions d'achat, écrites comme les tape un dirigeant qui cherche un prestataire plutôt qu'une définition, aux mêmes modèles chaque mois : ChatGPT, Perplexity et l'AI Mode de Google. On relève qui est cité, sur quelle question, et avec quelle source à l'appui. Le relevé sert à corriger les pages qui perdent leur citation d'un mois sur l'autre, pas à viser une position figée.
La liste ci-dessous reprend les points qui reviennent le plus souvent dans ce relevé, du plus déterminant au plus accessoire.
| Point vérifié | Ce qu'on regarde | Pourquoi ça compte |
|---|---|---|
| Réponse en ouverture | La page répond à la question dans les 200 premiers mots | C'est le passage que le modèle extrait en premier |
| Chiffres sourcés | Chaque donnée nomme son origine dans la phrase | Un chiffre sans source n'est pas repris |
| Format extractible | Un tableau ou une liste résume le point clé | Le modèle cite plus facilement une structure qu'un paragraphe |
| Robots.txt ouvert | GPTBot, OAI-SearchBot et PerplexityBot passent | Un robot bloqué ne lit jamais la page |
| Présence tierce | Avis, annuaires et articles qui citent l'entreprise existent | Le modèle recoupe plusieurs sources avant de nommer une marque |
#Les questions qu'on nous pose
Comment savoir si mon entreprise est déjà citée par ChatGPT
Posez vous-même une question d'achat sur votre secteur à ChatGPT, sans nommer votre entreprise, et regardez si vous apparaissez dans la réponse. Répétez avec 3 ou 4 formulations différentes : la réponse change souvent d'une question à l'autre.
Faut-il bloquer GPTBot pour protéger son contenu
Bloquer GPTBot retire une page de l'entraînement des futurs modèles, mais bloquer OAI-SearchBot retire aussi la page des réponses citées aujourd'hui. Les deux robots se paramètrent séparément dans le robots.txt, et c'est le second qui compte pour être cité.
Le référencement classique sert-il encore à être cité par une IA
Oui : un site bien structuré, rapide et déjà bien positionné sur Google reste plus facile à lire pour un modèle. Ce travail s'ajoute au référencement existant, il ne le remplace pas.
Combien de temps avant qu'une page corrigée soit citée
Le recrawl d'un robot IA prend en général quelques jours à quelques semaines, contre plusieurs mois pour un repositionnement Google classique. Le relevé mensuel suffit à voir si une correction a porté.
Un article de blog peut-il suffire à être cité
Un article seul aide sur une question précise, mais un modèle recoupe plusieurs pages avant de nommer une entreprise sur une question d'achat plus large. La présence tierce, avis et annuaires, pèse autant que le contenu du site.
Un audit gratuit montre sur quelles questions d'achat votre entreprise apparaît déjà, et sur lesquelles elle reste invisible. Le sujet touche à ce qu'un agent développé pour le référencement peut vérifier chaque jour, décrit dans ce qu'est un agent IA.
À lire ensuite
Tous les articles
SEOAI Mode de Google : ce que changent les premiers relevés de traficAI Mode de Google : ce que changent les premiers relevés de trafic
L’AI Mode de Google remplace la page de résultats par une conversation. Les premiers relevés chiffrent la chute de clics, et disent déjà ce qui reste visible.
18 septembre 20266 min
SEOSEO et IA : ce que l’agent écrit seul, ce que l’expert relitSEO et IA : ce que l’agent écrit seul, ce que l’expert relit
Le partage réel entre une machine qui publie chaque jour et un expert qui décide, tâche par tâche, sur les comptes qu’on pilote.
18 septembre 20266 min
SEOGEO, AEO, SEO : ce qui change quand on écrit pour être citéGEO, AEO, SEO : ce qui change quand on écrit pour être cité
Le tableau qui remet GEO, AEO et SEO à leur place, ce que les moteurs IA reprennent d'une page, et pourquoi le socle technique ne bouge pas.
4 septembre 20265 min