Référencement ChatGPT : comment votre site devient une source citée

Référencement ChatGPT : comment votre site devient une source citée
ChatGPT ne classe pas des liens, il rédige une réponse et nomme quelques sources. Pour en faire partie, deux conditions : que ses robots puissent lire vos pages, et que vos pages contiennent quelque chose qu’une machine peut reprendre sans se tromper. Tout le reste relève de l’interprétation, parce qu’OpenAI ne publie aucune consigne éditoriale.
Le mécanisme
ChatGPT cherche sur le web quand la question l’exige, et il reformule votre requête
D’après le centre d’aide d’OpenAI, ChatGPT lance une recherche « when your question would benefit from current information », et il « typically rewrites your query into one or more targeted queries ». Ce détail compte : la question posée par l’utilisateur n’est pas celle qui sert à trouver vos pages.
Pour trouver, ChatGPT s’appuie sur deux choses. Son propre index, alimenté par le robot OAI-SearchBot. Et des partenaires de recherche, qu’OpenAI nomme explicitement : Microsoft et Shopify. Cela veut dire qu’une partie de votre visibilité dans ChatGPT dépend de votre présence dans l’index de Bing.
Sur le choix des sources, OpenAI reste très général : le classement s’appuie sur « multiple factors intended to help users find relevant, reliable information », et la page ajoute une phrase qu’il faut garder en tête avant toute promesse : « Placement is not guaranteed. »
Technique
Quatre robots portent des noms différents parce qu’ils font des choses différentes
| Robot | À quoi il sert | Ce que change son blocage |
|---|---|---|
| OAI-SearchBot | faire apparaître le site dans la recherche ChatGPT | le site n’est plus montré dans les réponses de recherche, il peut subsister en lien de navigation |
| GPTBot | collecte pouvant servir à l’entraînement des modèles | le contenu sort de l’entraînement, aucun effet documenté sur les réponses |
| ChatGPT-User | visite déclenchée par un utilisateur dans ChatGPT | OpenAI précise que les règles du robots.txt « may not apply » pour ce cas |
| OAI-AdsBot | contrôle de sécurité des pages d’atterrissage publicitaires | non documenté |
Faites défiler le tableau sur mobile
OpenAI publie pour chacun un fichier de plages d’adresses IP, ce qui permet de vérifier qu’un visiteur qui se présente comme OAI-SearchBot en est bien un.
Le point mal rapporté
Bloquer GPTBot ne vous fait pas disparaître de ChatGPT
« Bloquez GPTBot et ChatGPT ne vous citera plus »
Les deux sujets sont confondus : l’entraînement des modèles et la recherche en direct.
Deux robots, deux effets séparés
« Disallowing GPTBot indicates a site’s content should not be used in training generative AI foundation models. » Rien sur la recherche. C’est OAI-SearchBot qui commande l’apparition dans les réponses.
La conséquence pratique est agréable : un éditeur peut refuser que ses textes servent à entraîner des modèles et rester visible dans les réponses de ChatGPT. Les deux décisions se prennent séparément, ligne par ligne, dans le fichier robots.txt.
Une décision à prendre selon votre modèle
Un média qui vit de ses pages vues et un artisan qui cherche des appels n’ont pas le même intérêt. Le premier peut vouloir se protéger, le second gagne presque toujours à être lisible. Il n’y a pas de réponse unique, et personne ne devrait vous en vendre une.
Le piège technique
Votre robots.txt peut autoriser pendant que votre pare-feu refuse
OpenAI le dit dans les deux sens. Côté recommandation : « we recommend allowing OAI-SearchBot in your site’s robots.txt file and allowing requests from our published IP ranges ». Côté support : il faut que l’hébergeur ou le réseau de diffusion « allows traffic from OpenAI’s published searchbot IP addresses ».
C’est le cas de figure le plus courant sur les sites que nous reprenons. Le robots.txt est parfait, et un pare-feu applicatif ou une protection anti-bot renvoie une erreur à tous les robots qu’il ne reconnaît pas. Rien ne le signale, sauf les journaux du serveur.
- Vérifier les journaux du serveurCherchez OAI-SearchBot, PerplexityBot et Claude-SearchBot sur les trente derniers jours. Aucune visite est une réponse en soi.
- Vérifier les règles du pare-feu et du CDNUne règle « bloquer les robots inconnus » suffit à vous rendre invisible.
- Vérifier la vitesse de réponseUn robot qui tombe sur des délais d’attente revient moins souvent.
Le contenu
OpenAI ne publie aucune consigne éditoriale, Microsoft si
Il faut le dire clairement : il n’existe pas d’équivalent des consignes de Google du côté d’OpenAI. Tout conseil rédactionnel « pour être cité par ChatGPT » est une déduction, pas une règle. Nous présentons les nôtres comme telles.
En revanche, comme ChatGPT s’appuie en partie sur Microsoft, les consignes publiées par Bing sont la source officielle la plus proche du sujet. Dans son annonce du 10 février 2026 sur le suivi des citations IA, Microsoft recommande d’approfondir l’expertise, de structurer les pages avec des titres, des tableaux et des questions-réponses, d’étayer par des preuves et des données, de tenir à jour, et d’utiliser IndexNow pour signaler les mises à jour.
Cela recoupe ce que l’article de recherche sur le GEO avait mesuré dès 2023 : citer des propos, donner des chiffres, écrire lisiblement et nommer ses sources font gagner de la place dans la réponse. Nous avons repris ce dossier dans notre définition du GEO.
Les autres moteurs
Perplexity et Claude suivent la même logique, avec leurs propres noms
| Moteur | Robot de recherche | Robot d’entraînement | Visite utilisateur |
|---|---|---|---|
| ChatGPT | OAI-SearchBot | GPTBot | ChatGPT-User |
| Perplexity | PerplexityBot | aucun robot d’entraînement déclaré | Perplexity-User |
| Claude | Claude-SearchBot | ClaudeBot | Claude-User |
Perplexity précise que PerplexityBot « is not used to crawl content for AI foundation models » et recommande de l’autoriser. Anthropic écrit que bloquer Claude-SearchBot « may reduce your site’s visibility and accuracy in user search results ». Deux anciens noms, anthropic-ai et claude-web, ne figurent plus dans la documentation : les laisser dans un robots.txt ne fait pas de mal, mais n’a plus d’effet connu.
Petite subtilité commune aux trois : les robots déclenchés par un utilisateur ne suivent pas forcément le robots.txt. Perplexity écrit même que son Perplexity-User « generally ignores robots.txt rules ». Un blocage n’est donc jamais total.
Passer à l’acte
Trois choses à faire cette semaine, dans cet ordre
Ouvrir le robots.txt et nommer les robots un par un
Pas de règle globale. Une ligne par robot, avec la décision qui correspond à votre modèle économique. Et on relit après, parce qu’une règle générique placée plus haut peut tout annuler.
Demander à l’hébergeur si les robots d’IA passent
Les plages d’adresses sont publiées par OpenAI, Perplexity et Anthropic. C’est une question de cinq minutes pour un hébergeur, et elle règle la moitié des cas.
Relever ce que les moteurs répondent aujourd’hui
Sur vos vraies questions de métier, plusieurs fois, sur plusieurs semaines. Une seule capture ne prouve rien : les réponses varient d’une exécution à l’autre.
Sur le fichier llms.txt, souvent présenté comme la solution au problème, les chiffres d’usage réels racontent autre chose : nous les avons compilés dans les chiffres d’usage du fichier llms.txt. Et si vous voulez simplement savoir où vous en êtes, l’audit permet de vérifier si ChatGPT vous cite.
Comment se référencer sur ChatGPT ?
Il n’existe pas d’inscription ni de soumission de site. ChatGPT trouve vos pages par son robot OAI-SearchBot et par ses partenaires de recherche. Le travail consiste donc à autoriser ce robot, à laisser passer ses adresses IP au niveau de l’hébergement, et à publier des pages qu’une machine peut résumer sans contresens.
Comment ChatGPT choisit-il les sources qu’il cite ?
OpenAI n’a jamais publié les critères. La seule formulation officielle parle de « multiple factors intended to help users find relevant, reliable information » et précise que le placement n’est pas garanti. Tout le reste, y compris ce que nous écrivons dans cet article, relève de l’observation.
Faut-il bloquer GPTBot pour protéger ses contenus ?
C’est un arbitrage, pas une bonne pratique. Bloquer GPTBot sort vos contenus de l’entraînement des modèles sans vous priver des réponses de recherche, à condition de laisser OAI-SearchBot passer. Un éditeur de presse et un artisan n’auront pas le même intérêt.
ChatGPT peut-il citer des informations fausses sur mon entreprise ?
Oui, et OpenAI l’écrit : « Search results and citations can be incomplete, outdated, or incorrect. » La parade n’est pas de corriger le moteur, c’est de rendre la bonne information facile à trouver et cohérente partout : site, fiche d’établissement, annuaires de métier.
Le référencement dans Bing compte-t-il pour ChatGPT ?
En partie, oui. OpenAI nomme Microsoft parmi ses partenaires de recherche. Soigner sa présence dans Bing Webmaster Tools, y compris la remontée des mises à jour par IndexNow, est donc un travail utile au-delà de Bing lui-même.
Sources, consultées le 25 septembre 2026
- OpenAI, Overview of OpenAI Crawlers, documentation développeurs.
- OpenAI, centre d’aide, Searching the web with ChatGPT.
- Perplexity, PerplexityBot and Perplexity-User, documentation.
- Anthropic, Does Anthropic crawl data from the web, and how can site owners block the crawler ?
- Bing Webmaster Blog, Introducing AI Performance in Bing Webmaster Tools, 10 février 2026.
Pour aller plus loin
Un relevé de ce que les moteurs répondent, avant de toucher au site
Les questions de votre métier posées aux moteurs, les sources citées à votre place, et les obstacles techniques qui vous en excluent. Le tout consigné, pour pouvoir comparer dans trois mois.
Web’up · Agence SEO et IA à La Garde, dans le Var · Interventions partout en France