Être cité par ChatGPT, Perplexity, Claude ou Gemini ne s'obtient ni par un formulaire ni par une astuce : l'assistant cite une page qu'il a pu lire, dont il a compris le contenu, dont il sait qui parle, et qui répond à la question posée. Cette page suit ces étapes dans l'ordre, avec ce que chaque éditeur documente, le contrôle du test GEO à lire, et la page qui détaille chaque correctif.
1. Ce qui décide d'une citation, d'après les éditeurs
Ce que le fournisseur documente. OpenAI documente trois robots et leur effet. OAI-SearchBot « sert à faire apparaître des sites dans les résultats des fonctions de recherche de ChatGPT », et « les sites qui ont refusé OAI-SearchBot ne seront pas montrés dans les réponses de recherche de ChatGPT ». ChatGPT-User « sert à certaines actions des utilisateurs dans ChatGPT ». GPTBot ne concerne que l'entraînement des modèles. Rien, dans cette documentation, ne décrit comment une source est choisie parmi celles que le robot peut lire (OpenAI, robots et crawlers).
Ce que nous recommandons. Partir de ce qui est documenté et s'y tenir : une citation suppose d'abord que le robot de réponse entre, puis qu'il trouve du texte, puis qu'il sache qui parle. Ce sont des prérequis, pas des garanties, et ils se vérifient un par un sur votre page d'accueil avec le test GEO, qui rapporte « Crawlers de réponse IA autorisés », « Texte lisible sans JavaScript » et « Entité d'identité (Organization, LocalBusiness, Person) ». Tout ce qui se dit au-delà, sur la façon dont un assistant classe ses sources, est de l'interprétation ; nous la signalons comme telle quand nous en faisons.
2. Être lu : robots.txt et CDN
Ce que le fournisseur documente. Anthropic décrit Claude-SearchBot, qui « parcourt le web pour améliorer la qualité des résultats de recherche », et Claude-User, qui accède à un site « quand une personne pose une question ». Ses robots « respectent les signaux robots.txt standard », se refusent par un groupe dédié, et leurs adresses IP sont publiées (Anthropic, exploration du web).
Ce que nous recommandons. Un seul groupe robots.txt où chaque robot de réponse est nommé et partage les règles de *, et une vérification depuis l'extérieur avec le user-agent de chaque robot, parce qu'un CDN ou un pare-feu peut renvoyer un défi que le fichier n'annonce pas. Le fichier, robot par robot, est dans Crawlers IA et robots.txt ; le cas du proxy dans Cloudflare et les robots IA.
Comment le corriger
User-agent: OAI-SearchBot
User-agent: ChatGPT-User
User-agent: Claude-SearchBot
User-agent: Claude-User
User-agent: PerplexityBot
User-agent: *
Allow: /
Disallow: /admin/
3. Être lisible : le texte dans le HTML
Ce que le fournisseur documente. Google est le seul éditeur à documenter l'exécution du JavaScript par ses robots, avec une file de rendu qui « peut prendre plus longtemps » que quelques secondes, et il recommande le rendu côté serveur parce que « tous les robots ne peuvent pas exécuter JavaScript » (Google, principes de base du SEO JavaScript). OpenAI, Anthropic et Perplexity ne documentent rien sur ce point.
Ce que nous recommandons. Considérer que le fetcher d'un assistant lit le HTML brut : titre, intertitres, texte des paragraphes, prix et données structurées doivent être dans la réponse HTTP, sans script. Une réponse directe en tête de page, dans les premières lignes, est ce qu'un assistant peut reprendre ; un contenu qui arrive après un appel AJAX n'existe pas pour lui. Le rendu serveur, pile par pile, est dans le contenu sans JavaScript.
4. Être identifié : Organization, sameAs, llms.txt
Ce que le fournisseur documente. Les données structurées Organization aident Google « à désambiguïser votre organisation dans les résultats de recherche » : nom légal, identifiants comme vatID ou iso6523Code, adresse, profils sameAs (Google, données structurées Organization). Aucun éditeur d'assistant ne documente son usage de ces données ; aucun ne documente le fichier llms.txt.
Ce que nous recommandons. Un nœud Organization sur chaque page, avec identifiant de registre, adresse, fondateur et profils exacts, et une phrase qui écarte les homonymes ; un llms.txt qui répète cette identité en texte. Un assistant qui hésite entre deux entités du même nom n'en cite aucune. Le graphe est dans Schema Organization et identité d'entité, le fichier dans llms.txt.
Comment le corriger
{
"@type": "Organization",
"name": "Votre marque",
"legalName": "VOTRE SOCIETE SAS",
"identifier": {"@type": "PropertyValue", "propertyID": "SIRET", "value": "12345678900012"},
"sameAs": ["https://www.linkedin.com/company/votre-marque"],
"description": "Agence de services à Bougival. À ne pas confondre avec le logiciel homonyme."
}
5. Assistant par assistant : ChatGPT, Perplexity, Claude, Gemini
Ce que le fournisseur documente. Perplexity distingue PerplexityBot, qui « fait apparaître et relie des sites dans les résultats de recherche de Perplexity » et respecte robots.txt, de Perplexity-User, qui « ignore généralement les règles robots.txt » parce qu'un utilisateur a demandé la page (Perplexity, crawlers). ChatGPT et Claude suivent le même schéma, un robot de recherche et un fetcher d'utilisateur, documenté dans les sections 1 et 2.
Ce que nous recommandons. Le même site sert les quatre. ChatGPT : OAI-SearchBot autorisé, et une page qui répond dans ses premières lignes. Perplexity : PerplexityBot autorisé, et des pages datées, parce que ses réponses citent des sources avec leur date. Claude : Claude-SearchBot et Claude-User autorisés, sans oublier le CDN. Gemini et le mode IA de Google : Google-Extended n'a pas d'effet sur la recherche selon Google, et le mode IA n'a « aucune exigence supplémentaire » ; ce qui est bien référencé sur Google peut y apparaître. Aucun des quatre ne propose de soumission d'URL ni d'équivalent de la Search Console.
6. Autorité et notoriété : ce qui n'est pas documenté
Ce que le fournisseur documente. Google précise qu'il n'y a « aucune exigence supplémentaire pour apparaître dans les aperçus IA ou le mode IA, ni d'optimisation spéciale nécessaire », et que le trafic issu de ces fonctions est « inclus dans le trafic de recherche global dans Search Console » (Google, fonctionnalités IA dans la recherche). Aucun éditeur d'assistant ne documente le poids des mentions tierces, des avis clients ou d'une fiche Google Business Profile dans ses réponses.
Ce que nous recommandons. Cette section est notre opinion, et rien ici n'est documenté par un éditeur. Nous observons que les pages citées sont souvent celles que d'autres sites citent déjà, et que les avis clients et les fiches d'annuaires reviennent dans les réponses sur les commerces locaux. Nous en tirons deux conseils prudents : tenir vos profils officiels cohérents avec votre site, même nom, même adresse, même activité ; et obtenir des mentions sur des sites que vos clients lisent. Nous ne promettons aucun effet, et nous refusons d'en chiffrer un.
Ce que nous avons fait sur seoforge.fr
Les quatre prérequis sont implémentés sur ce site et vérifiables : un robots.txt qui nomme chaque robot de réponse, des pages rendues côté serveur, un nœud Organization avec SIRET et une clause contre les homonymes, un llms.txt généré depuis la carte du site. Nous ne publions aucun taux de citation : nous n'en avons pas mesuré de façon publiable, et le test GEO ne le mesure pas.
Pour aller plus loin
Cette page suit le plan du guide du référencement IA, qui détaille chaque dimension avec ses sources. Si vous avez tout appliqué et que vous restez absent, le diagnostic pas à pas remonte la chaîne des causes, et mesurer sa visibilité dit comment le constater sans se tromper. Pour choisir qui vous accompagne, choisir une agence GEO donne les critères. L'Audit GEO reprend les six dimensions sur vos pages prioritaires et implémente les correctifs.
Questions fréquentes
Les avis Google influencent-ils la visibilité dans les IA ? Aucun éditeur ne le documente. Nous constatons que les réponses sur les commerces locaux reprennent souvent des avis et des fiches d'annuaires, et nous n'en faisons pas une règle.
Google Business Profile influence-t-il ChatGPT ? Rien de documenté non plus. Une fiche cohérente avec votre site est un bon usage en soi ; son effet sur un assistant n'est pas mesurable de façon fiable aujourd'hui.
Existe-t-il un formulaire pour être référencé sur ChatGPT ? Non, et aucun éditeur d'assistant n'offre d'équivalent de la Search Console. L'accès se règle dans votre robots.txt et votre CDN, le reste dans vos pages.