Aller au contenu
AEOGEOStratégie

Comment être cité par ChatGPT, Perplexity et les AI Overviews

Être premier sur Google et être cité par un assistant sont deux compétitions différentes, arbitrées par deux mécanismes différents. Voici le mécanisme, puis les six conditions qui décident réellement de la citation.

Publié le Mis à jour le 7 min de lecture 1,332 mots Cette page en Markdown

La demande arrive toujours sous la même forme : « nos concurrents sortent dans ChatGPT, pas nous ». La réponse commence par une distinction que la plupart des articles sautent — il existe deux chemins par lesquels un nom apparaît dans une réponse générée, et ils ne s'optimisent pas de la même façon.

Les deux chemins vers une réponse générée

Le premier chemin est la mémoire du modèle. Le modèle a été entraîné sur un instantané du web ; il « sait » que telle entreprise existe parce que suffisamment de textes l'ont mentionnée. Ce chemin est lent, collectif et hors de votre contrôle direct : on n'y entre pas en modifiant son site, mais en étant mentionné ailleurs — presse, annuaires, forums, pages de comparaison. Aucune modification faite aujourd'hui ne changera un modèle déjà entraîné.

Le second chemin est la récupération en direct. L'assistant lance une recherche, télécharge quelques pages, lit ce qu'il y trouve, et construit la réponse à partir de ce texte — en citant les URLs qu'il a réellement ouvertes. C'est ce chemin qui est actionnable cette semaine, et c'est celui dont parle tout le reste de cet article.

Pourquoi le premier résultat Google n'est pas la source citée

Un moteur de recherche classe des documents pour un humain qui va cliquer. Un moteur de réponse assemble un texte pour un humain qui ne cliquera probablement pas. Les deux systèmes ne récompensent donc pas les mêmes propriétés. Le classement récompense la pertinence et l'autorité du domaine ; la citation récompense en plus la facilité d'extraction : une affirmation courte, autonome, attribuable, qui répond exactement à la question posée et qui peut être recopiée sans être déformée.

C'est pourquoi une page longue, brillante et bien classée peut ne jamais être citée : si la réponse à « quel est le délai d'annulation ? » est diluée dans un paragraphe de narration, le modèle préférera la page d'un concurrent qui écrit « Annulation gratuite jusqu'à 48 heures avant l'arrivée. » — parce que cette phrase-là se cite sans risque.

La documentation publique de Google sur les fonctionnalités IA va dans le même sens : les fondamentaux du référencement continuent de s'appliquer, et le contenu doit apporter quelque chose d'unique plutôt que reformuler ce que dit déjà tout le monde. Autrement dit : pas de raccourci, mais une exigence supplémentaire.

Les six conditions d'une citation

1. La page doit pouvoir être lue sans JavaScript

Beaucoup d'agents récupèrent l'HTML brut et n'exécutent aucun script. Si votre contenu est injecté côté client, ils reçoivent une coquille vide. Le test tient en une commande, et le résultat est souvent un choc :

Combien de texte votre page contient-elle réellement ?
curl -sS -A "Mozilla/5.0 (compatible; test)" https://votre-domaine.com/ \
  | sed -e 's/<script[^>]*>.*<\/script>//g' -e 's/<[^>]*>/ /g' \
  | tr -s ' \n' ' ' | wc -w

# Moins de ~300 mots pour une page qui en affiche 1 500 dans le navigateur :
# le contenu est rendu par JavaScript et l'agent ne le voit pas.

2. L'entité doit être identifiable sans ambiguïté

Un modèle ne cite pas volontiers une entreprise qu'il ne parvient pas à situer. Nom exact, forme juridique, adresse complète, téléphone au format international, année de création, zone desservie : ces éléments doivent apparaître à la fois en texte visible et en données structurées, et être identiques aux deux endroits. Une contradiction entre le JSON-LD et le pied de page est un motif de prudence, donc de non-citation.

3. Le contenu doit être dense en faits, pas en adjectifs

« Un service de qualité, une équipe passionnée » ne contient aucune information extractible. « Intervention sous 4 heures à Casablanca, 7j/7, devis ferme avant travaux » en contient trois. Les faits comptables — chiffres, délais, périmètres, conditions — sont ce qu'un moteur de réponse peut réutiliser. Le reste est du remplissage, quel que soit son style.

4. La structure doit épouser la forme des questions

Les gens n'écrivent plus « riad Marrakech pas cher » à un assistant, ils écrivent une phrase complète. Vos titres H2 et H3 doivent ressembler à ces phrases, et la réponse doit tenir dans les deux ou trois lignes qui suivent immédiatement le titre. Le motif qui fonctionne est simple : question en titre, réponse directe en premier paragraphe, détails ensuite. L'inverse — contexte d'abord, réponse en bas — est exactement ce qui vous fait perdre la citation.

5. L'information doit être corroborable ailleurs

Un modèle qui vous cite engage sa fiabilité. Une affirmation qu'il retrouve sur votre site, sur votre fiche d'entreprise, dans un annuaire sectoriel et dans un article de presse devient sûre à réutiliser. Une affirmation qui n'existe que chez vous reste une déclaration. C'est la partie lente du travail, et c'est aussi celle que vos concurrents négligent le plus.

6. La fraîcheur doit être visible et vraie

Les questions à composante temporelle — prix, horaires, disponibilité, réglementation — favorisent les sources récentes. Une date de mise à jour affichée, un dateModified exact dans le JSON-LD et un sitemap dont les lastmod correspondent à la réalité valent mieux qu'une refonte. Attention toutefois : une date modifiée sans changement de contenu est un mensonge structuré, et c'est le genre de signal qui se retourne.

Ce qui ne marche pas

PratiquePourquoi c'est venduPourquoi ça échoue
Bourrage de mots-clés « IA »Réflexe SEO des années 2010Le modèle lit du sens, pas des occurrences ; la page paraît générique
Texte caché réservé aux robotsPromesse de gain sans réécritureContenu masqué : sanctionnable côté recherche, et sans effet côté agents
Acheter un « score de visibilité IA »Un chiffre rassureChaque outil a son barème ; un score n'est pas une citation
Publier 40 articles générésVolume = couvertureContenu de commodité : précisément ce que la doc de Google écarte
Ajouter llms.txt et s'arrêter làFacile, visible, à la modeLe fichier oriente, il ne rend pas votre page lue ni factuelle

Mesurer honnêtement

C'est le point où la plupart des prestations deviennent invérifiables. Trois mesures sont réelles ; tout le reste est une opinion mise en graphique.

  1. Vos journaux serveur. Les visites d'agents déclenchées par un humain (ChatGPT-User, Perplexity-User, Claude-User) sont datées, comptées et incontestables. Leur progression est le signal le plus proche d'une citation.
  2. Les referrers. Un visiteur arrivant depuis chatgpt.com ou perplexity.ai apparaît dans vos statistiques : c'est un clic sur une citation, donc la preuve la plus directe qui existe.
  3. Un panel de questions figé. Écrivez vingt questions réelles de vos clients, posez-les chaque mois aux mêmes assistants, notez qui est cité. Les réponses varient d'une exécution à l'autre : c'est une tendance sur plusieurs mois, jamais une mesure exacte — et quiconque vous présente ce chiffre sans cette réserve vous vend de la précision qu'il n'a pas.

L'ordre dans lequel travailler

Par retour sur temps investi, et pour un site qui part de zéro :

  • Semaine 1 — ce que l'agent peut lire. Vérifier ce qu'un agent reçoit sans JavaScript, corriger les pages vides, s'assurer que robots.txt n'interdit pas ce que vous voulez voir cité.
  • Semaine 2 — l'identité. JSON-LD Organization ou LocalBusiness complet, cohérent avec le texte visible, NAP identique partout.
  • Semaines 3–4 — les réponses. Réécrire les dix pages qui comptent au format question/réponse, avec des faits chiffrés à la place des adjectifs.
  • En continu — la corroboration. Fiches, annuaires sérieux, presse locale, partenariats : c'est ce qui déplace le premier chemin, celui de la mémoire du modèle.

Questions fréquentes

Combien de temps avant d'être cité par une IA ?

Sur le chemin de la récupération en direct, un correctif technique peut être visible en quelques jours, le temps que les pages soient re-téléchargées. Sur le chemin de la mémoire du modèle, il faut des mois et des mentions extérieures : aucune modification de votre site ne change un modèle déjà entraîné.

Faut-il bloquer les crawlers d'entraînement pour autant ?

C'est un arbitrage. Bloquer l'entraînement protège votre contenu mais retire vos textes du chemin lent. Bloquer les agents à la demande, en revanche, vous coûte des citations immédiates : ces requêtes sont déclenchées par un utilisateur qui vous cherche déjà.

Un score de visibilité IA a-t-il une valeur ?

Comme diagnostic, oui : il indique quels défauts techniques corriger. Comme mesure de résultat, non : chaque outil applique son propre barème, et aucun n'observe les citations réelles. Les journaux serveur et les referrers, eux, sont vérifiables.

Les AI Overviews de Google obéissent-ils aux mêmes règles ?

En partie. La documentation de Google indique que les fondamentaux du référencement restent valables et qu'aucun fichier spécifique n'est nécessaire. La lecture par un agent, l'identité claire et la densité factuelle servent les deux ; les fichiers destinés aux agents, eux, ne concernent pas Google Search.

Une URL suffit. L'audit rend le score, les douze points de contrôle et le détail de chaque échec. La première génération de fichiers est offerte.

Auditer mon site gratuitement

Retour au blog

Audit gratuit

Voyez ce que l'IA lit vraiment de vous.

Une URL suffit. L'audit rend le score, les douze points de contrôle et le détail de chaque échec. La première génération de fichiers est offerte.

Projet sur-mesure ou grand compte

Par téléphone

RÉPONSE SOUS 48H · ANGLAIS & FRANÇAIS

© 2026 Indexonic. Tous droits réservés.

Mentions légales The Web Master — Marrakech