GEO
返回博客
AI 平台可见度评估

追踪 500 条 ChatGPT 引用后,我们发现这 6 类来源最容易被选中

我们逐条追踪了 500 条 ChatGPT 引用,总结出最容易被选中的六类来源。能否获得引用,关键不在 Google 排名或域名权重,而在于内容是否便于提取、可核查且足够新。本文还会逐类分析,为什么有些页面排名靠前,却始终没有被引用。

Tenten GEO 团队发布于 2024-10-085 分钟阅读
示意图:一道柔光从众多来源中选出最容易引用的文档,象征 ChatGPT 筛选引用来源。

能否被 ChatGPT 引用,关键不在页面排名有多高、域名权重有多强,而在于内容能否被“干净地提取”,以及引用风险是否足够低。过去六个月,我们为客户开展 AI 可见度监测,并逐条归类了其中 500 条 ChatGPT 引用。结果高度集中:超过 80% 来自六类来源。如果你的页面不属于这六类,即使排在 Google 第一名,模型也很可能跳过你,转而引用排名第八、但更便于提取的页面。

这 500 条引用是如何统计的?

只有把样本交代清楚,才能判断这些结论适用于多大范围。这 500 条引用来自我们为 B2B 和 SaaS 客户开展 AI 可见度监测时获得的真实 ChatGPT 回答,既包括触发搜索后的问答,也包括模型直接附上来源链接的情况;主题涵盖产品对比、术语解释、选型建议和操作教程。我们逐条记录了引用 URL、该页面针对相应问题在 Google 前十名中的位置、页面结构类型,以及模型实际提取了哪些文字。这不是第三方学术研究,而是我们在项目执行中逐项标注得出的观察。样本偏向 B2B,也以英文和繁体中文查询为主。阅读下方比例时,请将这一前提考虑在内。

最容易被选中的六类来源

先看结论,再逐项拆解。按照引用次数从高到低,六类来源大致分布如下:

  1. 官方文档与产品页面(技术文档、定价页、更新日志):约 26%
  2. 包含原始数据的原创研究与调研页面:约 21%
  3. 第三方评测、对比与精选榜单(不包括品牌自制盘点):约 18%
  4. 论坛与社区讨论(Reddit、Stack Overflow、PTT、专业协会):约 14%
  5. 步骤清晰的操作指南与教程:约 12%
  6. 共识度高的参考页面(Wikipedia、行业术语页与标准页面):约 9%

官方文档排在第一并不意外。当用户询问“某款工具是否支持某项功能”或“某套方案价格多少”时,对模型来说,引用厂商自己的文档最稳妥:它是一手资料,责任主体明确,被纠正的概率也较低。这也解释了为什么不少 SaaS 企业频繁更新博客,最终被引用的却只有少数文档页和定价页。排名第二的原创研究,优势在于掌握“别人没有的数据”。只要一项调研明确说明样本、方法和时间,模型就可能把它视为可引用的事实来源,因为这些数据无法直接从其他地方复制。

信息图:ChatGPT 最常引用的六类来源及其占比
按照引用次数从高到低,列出最容易被 ChatGPT 选中的六类来源。

排名第三的第三方对比与榜单,满足了模型对“中立性”的要求。当用户问“A 和 B 哪个更好”时,模型往往倾向于引用既不属于 A、也不属于 B 的来源,避免答案显得像品牌自卖自夸。与其自己写十篇宣称优势的对比文章,不如设法进入其他机构整理的榜单。排名第四的社区讨论最容易被低估。Reddit 和各类专业论坛经常获得引用,因为它们提供了官方文档给不了的内容:真实用户踩过的坑,以及未经营销话术包装的评价。模型需要这种声音来平衡官方说法。

排名第五的操作教程,胜在结构。一篇教程如果用小标题提出问题,紧接着给出答案,并把步骤清楚编号,模型几乎可以原样提取,无须重新组织。排名第六的高共识参考页面,则是模型的“安全牌”:当一项事实得到多个来源交叉印证时,百科或标准页面通常会成为引用风险最低的选择。把这六类来源放在一起看,会发现它们有一个共同点。

共同点:易提取、可核查、足够新

这六类来源的域名权重差异很大。一条 Reddit 回复与某家厂商的官方文档显然不在同一个量级,却同时满足三个条件。易提取,是指答案本身就是一段可以独立成立的文字,模型不必读完整个页面再自行概括。可核查,是指内容有明确的来源、日期或数字;模型引用时可以标明出处或时间,不必担心用户质疑。足够新,是指页面标有清晰的更新时间,内容看起来尚未过期。排名遵循的是 Google 的逻辑,而这三点体现的是 AI 选择引用的逻辑,两者只有部分重合。

排名靠前却未被引用,通常是因为以下问题:

再看那些 Google 排名很好、却一次也没有被引用的页面,问题通常不在内容质量,而在于提取难度。以下几种常见写法,会直接把页面排除在引用候选之外。

  • 答案埋在长段落中间,前面先铺垫三句背景,导致模型找不到可以独立引用的句子。
  • 没有明确的发布日期或更新日期,模型无法判断内容是否已经过期。
  • 关键数字只放在图片或表格截图中,文本层无法抓取。
  • 全文都在用“我们的解决方案”这类第一人称营销口吻,因来源偏向性明显而被跳过。
  • 一个页面塞进十个主题,没有任何段落能够对应一个明确的问题。

如何让自己的内容进入这六类来源

不必六类全做,先选择与现有内容资产最接近的两三类。如果你经营 SaaS 产品,第一步是改写文档页和定价页上的每项功能与解决方案,统一采用“问题作为标题、答案放在第一句”的结构。这通常是投入产出比最高的一步。接着,整理一项只有你掌握的数据;哪怕只是对自家产品后台数据做匿名汇总,只要明确样本和时间,就有机会成为第二类来源。然后主动经营品牌在第三方榜单中的曝光,让其他人在对比文章里提到你。完成这三步,就覆盖了六类来源中引用命中率最高的三类。

与其问“怎样让 ChatGPT 多提到我几次”,不如先问:“模型能否从我的页面中直接引用一句话,一个字都不用改?”如果答案是否定的,这很可能就是内容尚未获得引用的原因。Tenten GEO

先做一件事:选出你最希望获得引用的那个问题,在 ChatGPT 中提问,看看它现在引用了谁,以及为什么选择对方而不是你。结果往往很扎眼:被引用的页面未必比你更权威,只是更容易提取。如果你想知道自己的页面卡在六类来源中的哪一层,以及应该先从哪一类入手,可以预约一次 30 分钟的 GEO 诊断。我们会用你的核心问题现场完整跑一遍。

常见问题

ChatGPT 最常引用哪类来源?
在我们追踪的 500 条引用中,官方文档和产品页面出现最多,约占 26%;其后依次是包含原始数据的原创研究、第三方对比榜单、社区讨论、操作教程,以及共识度高的参考页面。它们的共同点是易于提取、可以核查,而且足够新。
Google 排名第一,就一定会被 ChatGPT 引用吗?
不一定。我们追踪到的被引用页面,在 Google 上的平均排名是 4.6,近三分之一来自第 5 名或更靠后的位置。模型会优先选择能够干净提取、来源和日期明确的页面,排名只是影响因素之一。即使没有拿到第一名,内容仍有机会被选中。
怎样让内容获得 ChatGPT 引用?
在小标题下用第一句话直接回答问题,标明发布日期和更新日期,把关键数字保留在文本层,避免使用第一人称营销口吻,并争取进入第三方对比榜单。核心目标是让模型无需改写,就能直接引用其中一句话。

准备好了吗

你的品牌在 AI 答案中有多高的可见度?

通过 30 分钟 GEO 诊断,了解品牌在主要 AI 引擎中的可见度缺口,以及应该优先解决的问题。

预约 30 分钟诊断