Plus de la moitié des sources citées dans les AI Overviews ne figurent pas sur la première page des résultats naturels. L’analyse de 1 000 mots-clés à Taïwan fait ressortir un signal très net : ce n’est pas l’autorité du domaine qui détermine à elle seule si vous serez cité, mais la présence, sur la page, d’un passage que le moteur peut extraire proprement et reprendre tel quel. Le classement vous permet d’entrer dans la course ; l’extractibilité détermine qui sera effectivement cité.
Comment avons-nous mené cette analyse ?
Nous avons sélectionné 1 000 groupes de mots-clés locaux à Taïwan, principalement consacrés aux logiciels B2B, aux services aux entreprises et aux achats professionnels, tout en conservant un échantillon de requêtes grand public à fort volume. Toutes les recherches ont été effectuées en chinois, depuis Taïwan. Pour chaque groupe, nous avons relevé quatre éléments : l’apparition ou non d’un AI Overview, les sources citées, le texte extrait de chacune d’elles et l’emplacement de ce passage sur la page d’origine. Les résultats sur ordinateur et sur mobile ont été analysés séparément, sur une période concentrée au premier semestre 2026. Il ne s’agit donc pas d’une photographie prise un jour donné : les mêmes mots-clés ont été testés à plusieurs reprises afin d’écarter les fluctuations ponctuelles.
- Échantillon : 1 000 groupes de mots-clés en chinois ciblant Taïwan, dominés par les requêtes B2B et professionnelles
- Taux de déclenchement des AI Overviews : environ 34 %, avec un pic sur les requêtes informationnelles (« quoi », « comment », « lequel est le meilleur »)
- Lorsqu’un AI Overview apparaît, il cite en moyenne environ 5,2 sources
- Part des sources citées figurant parmi les dix premiers résultats naturels : environ 46 %
- Indicateurs relevés : taux de déclenchement, nombre de sources, format et emplacement dans la page des passages cités
Être bien classé ne suffit pas pour être cité.
C’est le résultat le plus contre-intuitif de l’analyse. Seules 46 % des sources citées figurent déjà parmi les dix premiers résultats naturels. Autrement dit, plus de la moitié proviennent de la deuxième page, voire de positions encore plus éloignées. La logique des AI Overviews se rapproche davantage de celle des featured snippets : le moteur détermine d’abord la forme de réponse adaptée à la question, puis parcourt l’ensemble de l’index pour trouver le passage le plus pertinent, au lieu de reprendre une section complète des pages les mieux classées. Ce mécanisme est appelé classement des passages : le moteur évalue des paragraphes, pas seulement des pages.
Prenons un cas observé dans nos données. Pour une série de requêtes comparant certains logiciels professionnels, le résultat classé en deuxième position noyait sa réponse dans un développement de 300 mots, dont le lecteur devait lui-même tirer la conclusion. Le résultat classé en quatorzième position résumait la différence en seulement deux phrases et dans un tableau à trois colonnes. C’est ce dernier que l’AI Overview a cité. Pour le moteur, un passage qui répond directement à la question vaut davantage qu’un texte long et complet, mais difficile à isoler.
Les quatre structures de contenu les plus souvent citées
Les passages extraits se concentrent dans un nombre très limité de formats. Quatre structures représentent à elles seules près de la moitié des citations. Leur point commun : des limites informationnelles claires. Le passage peut être isolé sans perdre son sens ni rendre la formulation bancale.
- Définition directe : la première ou la deuxième phrase sous le titre définit clairement le terme, sur le modèle « X est… ». C’est le type de passage le plus susceptible d’être cité, car il constitue naturellement une réponse.
- Étapes ou liste : une question portant sur « quoi » ou « comment » est décomposée en 3 à 7 points. Les AI Overviews reprennent souvent la liste presque intégralement.
- Tableau comparatif : deux ou trois options sont présentées selon les mêmes critères dans un tableau, un format particulièrement facile à exploiter pour répondre aux requêtes du type « A ou B ».
- Question suivie d’une réponse courte : le titre H2 ou H3 reprend une question formulée comme par l’utilisateur, puis y répond en 40 à 120 mots. L’ensemble forme une unité facile à citer.

Quels domaines apparaissent le plus souvent parmi les sources citées ?
Dcard, PTT et les grands médias restent fréquemment cités pour les requêtes grand public, ce qui correspond à l’habitude des internautes taïwanais de consulter les forums pour trouver des retours d’expérience. Sur les mots-clés B2B et les recherches liées aux achats professionnels, la situation s’inverse. La documentation officielle, les pages de comparaison de produits et les contenus de conseil associés à un auteur clairement identifié, à une date de mise à jour et à des sources vérifiables représentent la majorité des citations. Le moteur privilégie nettement les pages spécialisées et régulièrement révisées. À l’inverse, les fermes de contenus apparaissent très peu parmi les sources citées, même lorsque leurs pages restent bien classées. C’est une bonne nouvelle pour les marques qui investissent dans des contenus professionnels : la crédibilité peut être récompensée.
Sur un sujet professionnel, le moteur préfère citer une réponse courte, signée et datée plutôt que de reprendre une page entière composée d’un long texte anonyme.
À quoi ressemble un passage facile à citer ?
- Sa longueur se situe le plus souvent entre 40 et 120 mots en chinois. Au-delà, le passage risque d’être tronqué ; en dessous, il peut manquer d’informations.
- La conclusion arrive dès le début du paragraphe : la première phrase donne la réponse, sans longue mise en contexte.
- Le vocabulaire correspond à celui de la question : les termes employés dans le paragraphe permettent au moteur de faire facilement le rapprochement avec la requête.
- Chaque paragraphe répond à une seule question. Il ne mélange pas plusieurs sujets, ce qui préserve une frontière informationnelle nette.
Quelles conséquences pour votre stratégie de contenu ?
Vous n’avez pas besoin de refondre tout votre site. Commencez par sélectionner les 20 à 30 questions pour lesquelles vous souhaitez le plus être cité par l’IA. Vérifiez que chacune dispose, sur votre site, d’une page ou d’un paragraphe compréhensible de manière autonome. Trois ajustements simples peuvent ensuite faire la différence : placer la phrase de définition juste sous le titre, transformer les longs développements en listes ou en tableaux, et faire précéder les passages clés d’une question explicite. Ces trois actions n’ajoutent aucun contenu ; elles réorganisent ce que vous avez déjà écrit afin d’en améliorer nettement l’extractibilité dans les AI Overviews. C’est généralement par là que commence le premier niveau d’intervention de notre moteur de contenu GEO auprès de nos clients.
Vous souhaitez savoir quelles pages de votre site sont réellement reprises par l’IA et pour quelles questions à forte valeur vous restez absent ? Planifiez un diagnostic GEO de 30 minutes. Nous analyserons vos propres mots-clés et vous montrerons précisément les lacunes à combler, sans nous contenter de recommandations génériques.



