Pour être cité par ChatGPT, le facteur décisif n’est ni la position de votre page dans les résultats ni l’autorité de votre domaine. Le modèle privilégie les contenus qu’il peut « extraire proprement, avec un risque de citation suffisamment faible ». Nous avons classé une à une les 500 références ChatGPT relevées pour nos clients au cours des six derniers mois. Le résultat est très net : plus de 80 % relèvent de six types de sources. Si votre page n’entre dans aucune de ces catégories, le modèle peut l’ignorer même si elle occupe la première place sur Google, et lui préférer une page classée huitième, mais plus facile à exploiter.
Comment avons-nous comptabilisé ces 500 citations ?
Il faut préciser la composition de l’échantillon pour savoir jusqu’où ces conclusions peuvent être généralisées. Ces 500 réponses proviennent de résultats ChatGPT réellement observés dans le cadre de missions de suivi de la visibilité dans les IA pour des clients B2B et SaaS. Elles couvrent aussi bien les réponses qui lancent une recherche que celles auxquelles le modèle joint directement des liens vers ses sources. Les sujets vont des comparatifs de produits aux explications terminologiques, en passant par les conseils de sélection et les tutoriels pratiques. Pour chaque cas, nous avons consigné l’URL citée, sa présence éventuelle parmi les dix premiers résultats Google pour la question concernée, le type de structure de la page et la forme du texte extrait. Il ne s’agit pas d’une étude universitaire menée par un tiers, mais d’observations issues de notre travail opérationnel et annotées une à une. L’échantillon est orienté B2B et porte principalement sur des requêtes en anglais et en chinois traditionnel. Les proportions ci-dessous doivent être lues en tenant compte de ce contexte.
Les six types de sources les plus faciles à sélectionner
Commençons par les résultats avant d’examiner chaque catégorie. Classées par nombre décroissant de citations, les six sources se répartissent approximativement ainsi :
- Documentation officielle et pages produit (documentation technique, pages tarifaires, journaux des mises à jour) : environ 26 %
- Études originales et enquêtes publiant leurs données brutes : environ 21 %
- Avis, comparatifs et sélections réalisés par des tiers, hors listes publiées par la marque elle-même : environ 18 %
- Discussions sur des forums et dans des communautés (Reddit, Stack Overflow, PTT, associations professionnelles) : environ 14 %
- Guides pratiques et modes d’emploi clairement structurés, étape par étape : environ 12 %
- Pages de référence faisant largement consensus (Wikipedia, glossaires sectoriels et pages consacrées aux normes) : environ 9 %
La première place de la documentation officielle n’a rien de surprenant. Lorsqu’un utilisateur demande si un outil prend en charge une fonctionnalité ou combien coûte une solution, le choix le plus sûr pour le modèle consiste à citer les propres documents de l’éditeur : l’information est de première main, son origine est claire et le risque d’être contredit reste faible. Voilà pourquoi de nombreux éditeurs SaaS publient régulièrement sur leur blog, alors que seules quelques pages de documentation ou de tarification finissent par être citées. Les études originales arrivent en deuxième position grâce à leurs « chiffres introuvables ailleurs ». Une enquête qui précise son échantillon, sa méthode et sa période constitue pour le modèle une source factuelle susceptible d’être citée, puisque ses données ne peuvent pas simplement être reprises d’une autre publication.

Les comparatifs publiés par des tiers, en troisième position, répondent au besoin de neutralité du modèle. Face à une question comme « Quel est le meilleur choix entre A et B ? », il tend à citer une source qui n’appartient ni à A ni à B, afin que la réponse ne ressemble pas à un argumentaire commercial. Mieux vaut donc apparaître dans les sélections établies par d’autres que publier dix comparatifs où votre marque se proclame elle-même gagnante. Les discussions communautaires, quatrièmes du classement, sont les plus souvent sous-estimées. Reddit et les forums professionnels sont régulièrement cités parce qu’ils apportent ce que la documentation officielle ne peut pas fournir : les difficultés réellement rencontrées par les utilisateurs et des avis qui n’ont pas été reformulés par le marketing. Le modèle s’appuie sur ce ton pour contrebalancer le discours officiel.
Pour les tutoriels pratiques, classés cinquièmes, tout repose sur la structure. Lorsque chaque question figure dans un sous-titre, que la réponse vient immédiatement après et que les étapes sont clairement numérotées, le modèle peut reprendre presque tout le contenu sans avoir à le reformuler. Les pages de référence faisant largement consensus, en sixième position, lui servent de filet de sécurité : lorsqu’une information est corroborée par plusieurs sources, une page wiki ou une page consacrée à une norme devient l’option la moins risquée à citer. Ces six catégories ont toutes un point commun.
Leurs points communs : faciles à extraire, vérifiables et suffisamment récentes
L’autorité des domaines varie fortement entre ces six catégories. Une réponse sur Reddit et la documentation d’un éditeur ne jouent manifestement pas dans la même catégorie, mais toutes deux réunissent trois qualités. Un contenu facile à extraire fournit une réponse sous la forme d’un paragraphe autonome : le modèle n’a pas besoin de lire toute la page avant d’en produire sa propre synthèse. Un contenu vérifiable indique clairement sa source, sa date ou ses chiffres ; le modèle peut l’attribuer et l’horodater sans craindre que l’utilisateur ne le réfute. Enfin, un contenu suffisamment récent affiche une date de mise à jour explicite, car le modèle privilégie ce qui ne semble pas obsolète. Le classement relève de la logique de Google ; ces trois critères, de celle des citations par l’IA. Les deux ne se recoupent que partiellement.
Les pages bien classées mais jamais citées présentent généralement les défauts suivants :
À l’inverse, lorsqu’on étudie les pages très bien positionnées qui n’ont jamais été citées, le problème tient rarement à la qualité du fond. Il vient presque toujours de la difficulté à extraire l’information. Certaines pratiques éditoriales suffisent ainsi à vous écarter d’emblée des sources potentielles.
- La réponse est enfouie au milieu d’un long paragraphe, après trois phrases de contexte. Le modèle ne parvient pas à isoler une formulation qui puisse être citée telle quelle.
- Aucune date de publication ou de mise à jour n’est clairement indiquée : le modèle ne peut pas déterminer si le contenu est encore valable.
- Les chiffres clés figurent uniquement dans des images ou des captures d’écran de tableaux, sans être accessibles dans la couche texte.
- L’article adopte de bout en bout un discours commercial à la première personne autour de « notre solution » ; considéré comme biaisé, il est écarté.
- Dix sujets sont entassés sur la même page, sans qu’aucun paragraphe ne réponde à une question précise.
Comment faire de vos contenus l’une de ces six sources
Vous n’avez pas besoin de couvrir les six catégories : choisissez les deux ou trois qui correspondent le mieux aux ressources dont vous disposez. Si vous éditez un SaaS, commencez par réécrire chaque fonctionnalité et chaque solution présentée dans votre documentation et sur vos pages tarifaires selon une structure simple : « la question dans le titre, la réponse dès la première phrase ». C’est l’action qui offre le meilleur rendement. Publiez ensuite un chiffre que vous êtes seul à détenir, même s’il ne s’agit que d’une synthèse anonymisée des données issues de votre produit. Précisez l’échantillon et la période : ce contenu pourra alors devenir une source de deuxième niveau. Enfin, travaillez activement votre présence dans les sélections de tiers afin d’être mentionné dans leurs comparatifs. Ces trois actions couvrent les trois catégories au taux de citation le plus élevé.
Au lieu de vous demander « Comment obtenir davantage de mentions dans ChatGPT ? », posez-vous plutôt cette question : « Le modèle peut-il reprendre directement une phrase de ma page sans changer un seul mot ? » Si la réponse est non, vous savez pourquoi votre contenu n’est pas encore cité.— Tenten GEO
Commencez par une seule action : saisissez dans ChatGPT la question pour laquelle vous souhaitez le plus être cité, puis observez les sources qu’il utilise actuellement et demandez-vous pourquoi il les choisit à votre place. La réponse est souvent déconcertante : la page citée ne fait pas davantage autorité que la vôtre, elle est simplement plus facile à exploiter. Si vous souhaitez savoir à quel niveau, parmi ces six types de sources, votre page bloque et par lequel commencer, vous pouvez prendre rendez-vous pour un diagnostic GEO de 30 minutes. Nous testerons en direct vos propres questions stratégiques et analyserons les résultats avec vous.



