# Comment être cité par ChatGPT, Perplexity et les AI Overviews

> Être premier sur Google et être cité par un assistant sont deux compétitions différentes, arbitrées par deux mécanismes différents. Voici le mécanisme, puis les six conditions qui décident réellement de la citation.

Publié le: 2026-08-24 · Mis à jour le: 2026-08-26 · 7 min de lecture
Source: https://indexonic.com/blog/etre-cite-par-chatgpt-perplexity-ai-overviews/

La demande arrive toujours sous la même forme : « nos concurrents sortent dans ChatGPT, pas nous ». La réponse commence par une distinction que la plupart des articles sautent — il existe **deux chemins** par lesquels un nom apparaît dans une réponse générée, et ils ne s'optimisent pas de la même façon.

## Les deux chemins vers une réponse générée

**Le premier chemin est la mémoire du modèle.** Le modèle a été entraîné sur un instantané du web ; il « sait » que telle entreprise existe parce que suffisamment de textes l'ont mentionnée. Ce chemin est lent, collectif et hors de votre contrôle direct : on n'y entre pas en modifiant son site, mais en étant mentionné ailleurs — presse, annuaires, forums, pages de comparaison. Aucune modification faite aujourd'hui ne changera un modèle déjà entraîné.

**Le second chemin est la récupération en direct.** L'assistant lance une recherche, télécharge quelques pages, lit ce qu'il y trouve, et construit la réponse à partir de ce texte — en citant les URLs qu'il a réellement ouvertes. C'est ce chemin qui est actionnable cette semaine, et c'est celui dont parle tout le reste de cet article.

> **Conséquence pratique** — Si votre page ne peut pas être lue au moment de la récupération, aucune quantité de contenu ne compensera : vous n'êtes pas mal classé, vous êtes absent du corpus sur lequel la réponse est construite.

## Pourquoi le premier résultat Google n'est pas la source citée

Un moteur de recherche classe des documents pour un humain qui va cliquer. Un moteur de réponse assemble un texte pour un humain qui ne cliquera probablement pas. Les deux systèmes ne récompensent donc pas les mêmes propriétés. Le classement récompense la pertinence et l'autorité du domaine ; la citation récompense en plus la _facilité d'extraction_ : une affirmation courte, autonome, attribuable, qui répond exactement à la question posée et qui peut être recopiée sans être déformée.

C'est pourquoi une page longue, brillante et bien classée peut ne jamais être citée : si la réponse à « quel est le délai d'annulation ? » est diluée dans un paragraphe de narration, le modèle préférera la page d'un concurrent qui écrit « Annulation gratuite jusqu'à 48 heures avant l'arrivée. » — parce que cette phrase-là se cite sans risque.

La documentation publique de Google sur [les fonctionnalités IA](https://developers.google.com/search/docs/appearance/ai-features) va dans le même sens : les fondamentaux du référencement continuent de s'appliquer, et le contenu doit apporter quelque chose d'unique plutôt que reformuler ce que dit déjà tout le monde. Autrement dit : pas de raccourci, mais une exigence supplémentaire.

## Les six conditions d'une citation

### 1. La page doit pouvoir être lue sans JavaScript

Beaucoup d'agents récupèrent l'HTML brut et n'exécutent aucun script. Si votre contenu est injecté côté client, ils reçoivent une coquille vide. Le test tient en une commande, et le résultat est souvent un choc :

*Combien de texte votre page contient-elle réellement ?*

```
curl -sS -A "Mozilla/5.0 (compatible; test)" https://votre-domaine.com/ \
  | sed -e 's/<script[^>]*>.*<\/script>//g' -e 's/<[^>]*>/ /g' \
  | tr -s ' \n' ' ' | wc -w

# Moins de ~300 mots pour une page qui en affiche 1 500 dans le navigateur :
# le contenu est rendu par JavaScript et l'agent ne le voit pas.
```

### 2. L'entité doit être identifiable sans ambiguïté

Un modèle ne cite pas volontiers une entreprise qu'il ne parvient pas à situer. Nom exact, forme juridique, adresse complète, téléphone au format international, année de création, zone desservie : ces éléments doivent apparaître à la fois en texte visible et en données structurées, et être **identiques** aux deux endroits. Une contradiction entre le JSON-LD et le pied de page est un motif de prudence, donc de non-citation.

### 3. Le contenu doit être dense en faits, pas en adjectifs

« Un service de qualité, une équipe passionnée » ne contient aucune information extractible. « Intervention sous 4 heures à Casablanca, 7j/7, devis ferme avant travaux » en contient trois. Les faits comptables — chiffres, délais, périmètres, conditions — sont ce qu'un moteur de réponse peut réutiliser. Le reste est du remplissage, quel que soit son style.

### 4. La structure doit épouser la forme des questions

Les gens n'écrivent plus « riad Marrakech pas cher » à un assistant, ils écrivent une phrase complète. Vos titres H2 et H3 doivent ressembler à ces phrases, et la réponse doit tenir dans les deux ou trois lignes qui suivent immédiatement le titre. Le motif qui fonctionne est simple : question en titre, réponse directe en premier paragraphe, détails ensuite. L'inverse — contexte d'abord, réponse en bas — est exactement ce qui vous fait perdre la citation.

### 5. L'information doit être corroborable ailleurs

Un modèle qui vous cite engage sa fiabilité. Une affirmation qu'il retrouve sur votre site, sur votre fiche d'entreprise, dans un annuaire sectoriel et dans un article de presse devient sûre à réutiliser. Une affirmation qui n'existe que chez vous reste une déclaration. C'est la partie lente du travail, et c'est aussi celle que vos concurrents négligent le plus.

### 6. La fraîcheur doit être visible et vraie

Les questions à composante temporelle — prix, horaires, disponibilité, réglementation — favorisent les sources récentes. Une date de mise à jour affichée, un `dateModified` exact dans le JSON-LD et un sitemap dont les `lastmod` correspondent à la réalité valent mieux qu'une refonte. Attention toutefois : une date modifiée sans changement de contenu est un mensonge structuré, et c'est le genre de signal qui se retourne.

## Ce qui ne marche pas

| Pratique | Pourquoi c'est vendu | Pourquoi ça échoue |
| --- | --- | --- |
| Bourrage de mots-clés « IA » | Réflexe SEO des années 2010 | Le modèle lit du sens, pas des occurrences ; la page paraît générique |
| Texte caché réservé aux robots | Promesse de gain sans réécriture | Contenu masqué : sanctionnable côté recherche, et sans effet côté agents |
| Acheter un « score de visibilité IA » | Un chiffre rassure | Chaque outil a son barème ; un score n'est pas une citation |
| Publier 40 articles générés | Volume = couverture | Contenu de commodité : précisément ce que la doc de Google écarte |
| Ajouter llms.txt et s'arrêter là | Facile, visible, à la mode | Le fichier oriente, il ne rend pas votre page lue ni factuelle |

## Mesurer honnêtement

C'est le point où la plupart des prestations deviennent invérifiables. Trois mesures sont réelles ; tout le reste est une opinion mise en graphique.

1. **Vos journaux serveur.** Les visites d'agents déclenchées par un humain (`ChatGPT-User`, `Perplexity-User`, `Claude-User`) sont datées, comptées et incontestables. Leur progression est le signal le plus proche d'une citation.
2. **Les referrers.** Un visiteur arrivant depuis `chatgpt.com` ou `perplexity.ai` apparaît dans vos statistiques : c'est un clic sur une citation, donc la preuve la plus directe qui existe.
3. **Un panel de questions figé.** Écrivez vingt questions réelles de vos clients, posez-les chaque mois aux mêmes assistants, notez qui est cité. Les réponses varient d'une exécution à l'autre : c'est une tendance sur plusieurs mois, jamais une mesure exacte — et quiconque vous présente ce chiffre sans cette réserve vous vend de la précision qu'il n'a pas.

## L'ordre dans lequel travailler

Par retour sur temps investi, et pour un site qui part de zéro :

- **Semaine 1 — ce que l'agent peut lire.** Vérifier ce qu'un agent reçoit sans JavaScript, corriger les pages vides, s'assurer que robots.txt n'interdit pas ce que vous voulez voir cité.
- **Semaine 2 — l'identité.** JSON-LD Organization ou LocalBusiness complet, cohérent avec le texte visible, NAP identique partout.
- **Semaines 3–4 — les réponses.** Réécrire les dix pages qui comptent au format question/réponse, avec des faits chiffrés à la place des adjectifs.
- **En continu — la corroboration.** Fiches, annuaires sérieux, presse locale, partenariats : c'est ce qui déplace le premier chemin, celui de la mémoire du modèle.

> **Point de départ gratuit** — L'audit Indexonic exécute la première semaine à votre place : il récupère votre page comme un agent, compte le texte réellement disponible, contrôle les données structurées et vérifie chaque lien publié. Sans compte pour le premier scan.


## Questions fréquentes

### Combien de temps avant d'être cité par une IA ?
Sur le chemin de la récupération en direct, un correctif technique peut être visible en quelques jours, le temps que les pages soient re-téléchargées. Sur le chemin de la mémoire du modèle, il faut des mois et des mentions extérieures : aucune modification de votre site ne change un modèle déjà entraîné.

### Faut-il bloquer les crawlers d'entraînement pour autant ?
C'est un arbitrage. Bloquer l'entraînement protège votre contenu mais retire vos textes du chemin lent. Bloquer les agents à la demande, en revanche, vous coûte des citations immédiates : ces requêtes sont déclenchées par un utilisateur qui vous cherche déjà.

### Un score de visibilité IA a-t-il une valeur ?
Comme diagnostic, oui : il indique quels défauts techniques corriger. Comme mesure de résultat, non : chaque outil applique son propre barème, et aucun n'observe les citations réelles. Les journaux serveur et les referrers, eux, sont vérifiables.

### Les AI Overviews de Google obéissent-ils aux mêmes règles ?
En partie. La documentation de Google indique que les fondamentaux du référencement restent valables et qu'aucun fichier spécifique n'est nécessaire. La lecture par un agent, l'identité claire et la densité factuelle servent les deux ; les fichiers destinés aux agents, eux, ne concernent pas Google Search.

---
Indexonic — https://indexonic.com · https://agent.indexonic.com
