La demande arrive toujours sous la même forme : « nos concurrents sortent dans ChatGPT, pas nous ». La réponse commence par une distinction que la plupart des articles sautent — il existe deux chemins par lesquels un nom apparaît dans une réponse générée, et ils ne s'optimisent pas de la même façon.
Les deux chemins vers une réponse générée
Le premier chemin est la mémoire du modèle. Le modèle a été entraîné sur un instantané du web ; il « sait » que telle entreprise existe parce que suffisamment de textes l'ont mentionnée. Ce chemin est lent, collectif et hors de votre contrôle direct : on n'y entre pas en modifiant son site, mais en étant mentionné ailleurs — presse, annuaires, forums, pages de comparaison. Aucune modification faite aujourd'hui ne changera un modèle déjà entraîné.
Le second chemin est la récupération en direct. L'assistant lance une recherche, télécharge quelques pages, lit ce qu'il y trouve, et construit la réponse à partir de ce texte — en citant les URLs qu'il a réellement ouvertes. C'est ce chemin qui est actionnable cette semaine, et c'est celui dont parle tout le reste de cet article.
Pourquoi le premier résultat Google n'est pas la source citée
Un moteur de recherche classe des documents pour un humain qui va cliquer. Un moteur de réponse assemble un texte pour un humain qui ne cliquera probablement pas. Les deux systèmes ne récompensent donc pas les mêmes propriétés. Le classement récompense la pertinence et l'autorité du domaine ; la citation récompense en plus la facilité d'extraction : une affirmation courte, autonome, attribuable, qui répond exactement à la question posée et qui peut être recopiée sans être déformée.
C'est pourquoi une page longue, brillante et bien classée peut ne jamais être citée : si la réponse à « quel est le délai d'annulation ? » est diluée dans un paragraphe de narration, le modèle préférera la page d'un concurrent qui écrit « Annulation gratuite jusqu'à 48 heures avant l'arrivée. » — parce que cette phrase-là se cite sans risque.
La documentation publique de Google sur les fonctionnalités IA va dans le même sens : les fondamentaux du référencement continuent de s'appliquer, et le contenu doit apporter quelque chose d'unique plutôt que reformuler ce que dit déjà tout le monde. Autrement dit : pas de raccourci, mais une exigence supplémentaire.
Les six conditions d'une citation
1. La page doit pouvoir être lue sans JavaScript
Beaucoup d'agents récupèrent l'HTML brut et n'exécutent aucun script. Si votre contenu est injecté côté client, ils reçoivent une coquille vide. Le test tient en une commande, et le résultat est souvent un choc :
curl -sS -A "Mozilla/5.0 (compatible; test)" https://votre-domaine.com/ \
| sed -e 's/<script[^>]*>.*<\/script>//g' -e 's/<[^>]*>/ /g' \
| tr -s ' \n' ' ' | wc -w
# Moins de ~300 mots pour une page qui en affiche 1 500 dans le navigateur :
# le contenu est rendu par JavaScript et l'agent ne le voit pas.2. L'entité doit être identifiable sans ambiguïté
Un modèle ne cite pas volontiers une entreprise qu'il ne parvient pas à situer. Nom exact, forme juridique, adresse complète, téléphone au format international, année de création, zone desservie : ces éléments doivent apparaître à la fois en texte visible et en données structurées, et être identiques aux deux endroits. Une contradiction entre le JSON-LD et le pied de page est un motif de prudence, donc de non-citation.
3. Le contenu doit être dense en faits, pas en adjectifs
« Un service de qualité, une équipe passionnée » ne contient aucune information extractible. « Intervention sous 4 heures à Casablanca, 7j/7, devis ferme avant travaux » en contient trois. Les faits comptables — chiffres, délais, périmètres, conditions — sont ce qu'un moteur de réponse peut réutiliser. Le reste est du remplissage, quel que soit son style.
4. La structure doit épouser la forme des questions
Les gens n'écrivent plus « riad Marrakech pas cher » à un assistant, ils écrivent une phrase complète. Vos titres H2 et H3 doivent ressembler à ces phrases, et la réponse doit tenir dans les deux ou trois lignes qui suivent immédiatement le titre. Le motif qui fonctionne est simple : question en titre, réponse directe en premier paragraphe, détails ensuite. L'inverse — contexte d'abord, réponse en bas — est exactement ce qui vous fait perdre la citation.
5. L'information doit être corroborable ailleurs
Un modèle qui vous cite engage sa fiabilité. Une affirmation qu'il retrouve sur votre site, sur votre fiche d'entreprise, dans un annuaire sectoriel et dans un article de presse devient sûre à réutiliser. Une affirmation qui n'existe que chez vous reste une déclaration. C'est la partie lente du travail, et c'est aussi celle que vos concurrents négligent le plus.
6. La fraîcheur doit être visible et vraie
Les questions à composante temporelle — prix, horaires, disponibilité, réglementation — favorisent les sources récentes. Une date de mise à jour affichée, un dateModified exact dans le JSON-LD et un sitemap dont les lastmod correspondent à la réalité valent mieux qu'une refonte. Attention toutefois : une date modifiée sans changement de contenu est un mensonge structuré, et c'est le genre de signal qui se retourne.
Ce qui ne marche pas
| Pratique | Pourquoi c'est vendu | Pourquoi ça échoue |
|---|---|---|
| Bourrage de mots-clés « IA » | Réflexe SEO des années 2010 | Le modèle lit du sens, pas des occurrences ; la page paraît générique |
| Texte caché réservé aux robots | Promesse de gain sans réécriture | Contenu masqué : sanctionnable côté recherche, et sans effet côté agents |
| Acheter un « score de visibilité IA » | Un chiffre rassure | Chaque outil a son barème ; un score n'est pas une citation |
| Publier 40 articles générés | Volume = couverture | Contenu de commodité : précisément ce que la doc de Google écarte |
| Ajouter llms.txt et s'arrêter là | Facile, visible, à la mode | Le fichier oriente, il ne rend pas votre page lue ni factuelle |
Mesurer honnêtement
C'est le point où la plupart des prestations deviennent invérifiables. Trois mesures sont réelles ; tout le reste est une opinion mise en graphique.
- Vos journaux serveur. Les visites d'agents déclenchées par un humain (
ChatGPT-User,Perplexity-User,Claude-User) sont datées, comptées et incontestables. Leur progression est le signal le plus proche d'une citation. - Les referrers. Un visiteur arrivant depuis
chatgpt.comouperplexity.aiapparaît dans vos statistiques : c'est un clic sur une citation, donc la preuve la plus directe qui existe. - Un panel de questions figé. Écrivez vingt questions réelles de vos clients, posez-les chaque mois aux mêmes assistants, notez qui est cité. Les réponses varient d'une exécution à l'autre : c'est une tendance sur plusieurs mois, jamais une mesure exacte — et quiconque vous présente ce chiffre sans cette réserve vous vend de la précision qu'il n'a pas.
L'ordre dans lequel travailler
Par retour sur temps investi, et pour un site qui part de zéro :
- Semaine 1 — ce que l'agent peut lire. Vérifier ce qu'un agent reçoit sans JavaScript, corriger les pages vides, s'assurer que robots.txt n'interdit pas ce que vous voulez voir cité.
- Semaine 2 — l'identité. JSON-LD Organization ou LocalBusiness complet, cohérent avec le texte visible, NAP identique partout.
- Semaines 3–4 — les réponses. Réécrire les dix pages qui comptent au format question/réponse, avec des faits chiffrés à la place des adjectifs.
- En continu — la corroboration. Fiches, annuaires sérieux, presse locale, partenariats : c'est ce qui déplace le premier chemin, celui de la mémoire du modèle.