大多数团队只把 URL 当作路由配置,但 AI 引擎会把 URL 当成一段文本来读,据此判断页面在讲什么、是否值得引用。对繁体中文网站来说,还要多做一个选择:slug 究竟用中文还是英文。下面将路径和 slug 分开说明,方便你直接调整现有规划。
AI 引擎如何“阅读”你的 URL?
LLM 的搜索系统会拆解 URL 中的词语来理解页面,并在生成答案、标注来源时展示它。像 /blog/url-structure-llm-friendly 这样的 URL,等于直接告诉模型“这个页面讨论 URL 结构”;换成 /p?id=48213,模型就得不到任何主题线索,只能完全依赖页面内容进行判断。当多个来源的其他条件接近时,可读且与主题相关的 URL 往往更容易被选为引用来源,因为它降低了模型和用户双方的理解成本。
路径层级本身也会传递上下文。看到 /geo-audit/pricing,用户很快就能判断这是 GEO 审计的价格页面,模型也能识别它所属的主题。路径过深还会带来另一项成本:页面离首页越远、指向它的内部链接越少,爬虫漏掉它的概率就越高;如果内容根本没有被发现,AI 引擎自然也无法检索。可读性与可抓取性是两个问题,但都受 URL 结构影响。
繁体中文 slug 的难题:汉字会被转换为百分号编码
只要 URL 中包含汉字,浏览器和服务器就会对其进行百分号编码。/blog/url structure plan 在实际存储、分享和引用时,会变成 /%E9%83%A8%E8%90%BD%E6%A0%BC/… 这样的长字符串。地址栏里看到的是中文,实际传输的却是编码;AI 摘要、社区分享卡片和后台报表收到的也都是这串字符,原本想表达的语义随之丢失。更麻烦的是,部分第三方工具和 AI 爬虫对这类编码 URL 的处理并不一致,偶尔还会出现截断或解析失败。
- 中文 slug(如 /blog/url structure planning):在地址栏中看起来清晰,但传输和引用时会变成 %E9%83%A8... 这样的百分号编码,AI 摘要、分享链接和报表都很难识别其含义。
- 英文或罗马字拼写的 slug(如 /blog/url-structure-llm-friendly):跨系统表现稳定、易于阅读,也便于 AI 清晰引用,是 B2B SaaS 网站更务实的首选。
- 标题文字使用繁体中文,slug 使用精简英文:这是目前更有利于 AI 检索的稳定组合。slug 不必完整翻译标题,用两三个能概括核心概念的英文词即可。
需要强调的是,繁体中文仍应出现在真正重要的位置:页面标题、H1 和正文都继续使用繁体中文,它们才是参与排名和供读者阅读的主体。slug 属于底层基础设施,抓住核心概念即可。URL 还应统一使用小写。部分服务器会把 /Blog 和 /blog 视为两个不同页面,大小写混用可能在不知不觉中产生重复 URL。如果现有中文 slug 已被收录多年,不要急着一次性全部更换;改版时务必通过 301 重定向承接旧 URL。
对 AI 友好的路径规划:可直接执行的原则
- 路径越浅越好:主要内容尽量控制在两到三层以内(/blog/<slug>)。每增加一层,被漏抓的风险都会上升。
- slug 要有明确语义:使用能够描述内容的词,不要使用流水号或日期。/blog/url-structure-llm-friendly 优于 /blog/2026/07/post-482。
- 全站保持一致:同一类内容采用相同的路径格式,让爬虫和模型能够预判你的网站结构。
- 统一小写并用连字符分隔:所有字母使用小写,单词之间使用“-”而不是下划线“_”,避免大小写或符号差异产生重复 URL。
- 不要把主要内容藏在查询参数后面:?id=、?p= 这类 URL 更难获得稳定收录和引用。
- URL 一旦公开,不要随意更改:确实需要调整时,必须设置 301 重定向,承接旧 URL 已积累的权重和引用。

让路径结构与内容集群相匹配
通过网站内部链接体现支柱内容、内容集群和子主题之间的关系,有助于 AI 引擎判断你在哪些主题上积累了足够深度。同一支柱主题下的文章彼此互链,并共同指向支柱页面,模型就能看出这个领域拥有系统化内容,而不是一批零散文章。集群页面与子主题文章之间的双向链接,也方便模型沿着链接理解完整主题,而不是只抓取一个孤立页面。只要内部链接规划到位,URL 是否必须按内容集群分层,反而是次要问题。
繁体中文网站的多语言规划:语言前缀与 hreflang
如果网站像许多 B2B 网站一样需要服务多个语言版本,应把语言前缀放在路径开头,例如 /zh-TW/blog/… 和 /en/blog/…。这样既能让语言版本一目了然,也便于爬虫分区处理。各语言页面必须通过 hreflang 相互标注,并指定 x-default 作为默认版本。这样,AI 引擎和搜索引擎才能向不同用户提供正确的语言页面,避免把各版本视为重复内容并相互稀释。
- 语言前缀放在路径开头:/zh-TW/blog/...、/en/blog/...,语言版本一目了然,也便于爬虫分区处理。
- 各语言版本通过 hreflang 相互标注,并指定 x-default 作为默认版本(繁体中文网站通常选择英文版或 zh-Hant 作为默认版本)。
- 不同语言版本尽量使用相同的 slug:翻译内容,不改路径,让页面之间的映射关系更清晰,也避免被视为重复内容。
最容易踩中的坑
最常见的问题包括:把发布日期写进路径,半年后 URL 就显得过时;直接用数据库流水号充当 slug,模型完全读不出页面主题;修改标题时顺手更换 slug,却没有设置重定向,相当于一次性丢掉已经积累的引用;同一页面同时存在带斜杠和不带斜杠、带 www 和不带 www 的版本,让爬虫把一个页面当成多个页面。这些问题修复起来并不复杂,但长期放任不管,会持续稀释页面被 AI 引用的机会。
URL 结构属于一次规划正确、长期持续受益的底层技术。为了迎合 AI,你不必重写整个网站。多数情况下,只要让 slug 具备明确语义、缩短路径层级、正确标注多语言 hreflang,并用 301 重定向收口旧 URL,就能逐步拉开差距。如果想确认自己的网站在可抓取性和可引用性上具体缺在哪里,Tenten GEO 的 30 天 GEO 审计会逐页检查路径、结构化数据和搜索表现。如果想先明确方向,也可以前往 /contact 预约一次 30 分钟的 GEO 诊断,我们会直接讨论你的网站结构。



