实战指南 2026年9月16日

如何让 AI 引用我的网站:引用要连过三道关,多数网站卡在第二道

AI 不引用你的网站,往往不是内容不够好,而是卡在检索、采信、摘录三道关中的某一关。本文给出每一关的失败表现与对应的诊断动作,按 ChatGPT、Perplexity、Google 的官方机制说明“为什么它不引用我”,并给出引用率的正确测法与一份 30 天行动清单。

#GEO #AI引用 #AI搜索 #ChatGPT #Perplexity

TL;DR / 核心要点总结

  • “AI 不引用我”不是一个问题,而是三个。 一次引用要连过三道关:检得到(进入候选池)、信得过(被判定为可用证据)、摘得走(能被整段摘出)。三关失败的结果都显示为“没被引用”,但对策完全不同。
  • 引用是段落级的,不是网页级的。 Google 开发者文档把 Gemini 的引用颗粒度定义为“段落对段落”,Anthropic 的 Citations API 同样是逐句引用——“我这一整页讲得很好”没有意义,“我这一段能不能被单独摘走”才有意义。
  • 多数网站卡在第二关。 SEJ 实测 50 个大站,可抓取层平均 74.4% 已经及格,语义标注层只剩 38.5%——能不能被抓到大多已不是问题,“AI 知不知道这一页在讲什么”才是分水岭。
  • 官网不是引用主力,但在事实题上反超。 16.7 万次引用的研究显示 85.7% 的引用指向第三方;而在无品牌指向的事实性问题上,第一方官网引用占比反超 40%——AI 做的是“证据匹配”,不是“所有权偏好”。
  • 先排除两种假象,再改内容。 引用率骤降可能只是模型换代噪声,被引用也可能只是“幽灵引用”(62%–73% 的引用看不见品牌)。

一、“AI 不引用我”不是一个问题,而是三个

多数人问这个问题时,期待的是拿到一份动作清单。但引用不是开关,而是一条流水线——任何一次引用,都意味着引擎完成了三步判断,任何一步没过,结果都显示为“没被引用”。

关卡引擎在这一步做什么失败时的典型表现你该先查什么
第一关 检得到把问题拆成多个子查询,从索引或检索池召回候选页面答案里完全没有你,连品牌名都不出现爬虫日志、robots 放行、页面是否被收录
第二关 信得过判断这个来源有没有资格当证据竞品被引用了、你没有;或引用了你,却写出与你定位不符的描述实体一致性、语义标注、数据口径、第三方印证
第三关 摘得走从页面里摘出一句能直接放进答案的话被引用了,但锚点落在页脚或无关段落;或答案用了你的内容却没标你段落能否独立成立、结论位置、表格与列表的使用

这三关是串行的:第一关没过,后两关的动作全部无效;第二关没过,段落改得再漂亮也不会被采信。所以先定位关卡,再投入动作——这也是本文与 GEO 优化怎么做 的分工:那篇讲五个工作面按什么顺序推进,本文只处理一个单点结果,一次引用在哪里断掉。


二、第一关:检得到——AI 在这一轮提问里根本没看到你

这一关有两个独立的子问题:爬虫能不能进来,页面能不能被召回。

爬虫要分级放行。 OpenAI 官方的分工很明确:OAI-SearchBot 负责 ChatGPT 搜索的收录与摘要,放行它才可能被引用;GPTBot 只负责训练,屏蔽它不影响搜索引用。Anthropic 同样三爬虫分权:ClaudeBot 管训练、Claude-SearchBot 管检索、Claude-User 负责用户主动抓取。所以“我们禁了 AI 爬虫”这句话没有信息量——禁了哪一个才是关键

被收录 ≠ 被召回,“查询扇出”是常被忽略的一层。 Google 官方文档提到,模型会把问题拆成多个子搜索(query fan-out),每个子搜索独立选源。你丢掉的往往不是主问题的排名,而是某个子问题的覆盖:用户问“A 与 B 哪个更适合中小企业”,你的页面写全了参数,却没有一句回答“小团队该怎么选”,这个子查询就会去引用别人。OpenAI 侧也做过类似调整——8 月 8 日起带 site: 的定向抓取比例从 0.37% 提到 16.8%(约 46 倍),官方品牌站与机构源引用上涨 73%(完整时间线与数据)。

这一关的及格线其实不高。 SEJ 实测 50 个大型网站,可抓取层平均 74.4% 及格(三层断层完整数据)。含义很直接:卡在第一关,大概率是配置事故,不是能力问题——403、429、超时、robots 误伤、纯 JS 渲染,都是常见的静默杀手。

诊断动作

  1. 拉一周服务器日志,按 UA 过滤 OAI-SearchBot / PerplexityBot / Claude-SearchBot / Googlebot,看状态码分布——403、429 与超时排在最前面。
  2. 逐类确认 robots.txt 放行策略:训练型与检索型分开决定,不要一条 Disallow 全禁。
  3. 在 ChatGPT、Perplexity 里各问一个你确定自己该赢的事实性问题,看引用里有没有你。

三、第二关:信得过——看到了,但不敢拿你当证据

模型采信一个来源,要三件事同时成立:知道你是谁(实体)、内容可信(口径)、别处能印证(交叉验证)。这是三关里最容易被跳过、也最容易做错的一关。

(1)实体:先确认“你是谁”没有歧义。 模型对不一致的容忍度极低——官网叫“XX 科技”、第三方档案叫“XX 信息科技”,就会被当成两个对象。有个成本极低的自测:把品牌名单独丢给 AI 问“这是谁”,看它给出的描述与你的官网定位是否一致。 不一致,问题在实体层,不在内容层(关于页就是按这个思路做的实体锚点)。

(2)语义标注:让机器知道这一页讲的是什么。 50 站实测里,第二层“归因与语义层”(JSON-LD 结构化数据)平均只有 38.5%,只有 70% 的主页部署了 JSON-LD,接近三分之一的站点全站找不到结构化数据。需要提醒的是:结构化数据解决“读懂”,不解决“凭什么信你”——它是必要条件,不是理由(写法与常见错误)。

(3)口径:没有来源的数字是负资产。 可被采信的数字要有三件套:来源、时间、统计口径。缺一件,模型要么不用、要么用错——用错比不用更糟,因为你控制不了它把哪个数字放进答案。

(4)交叉验证:官网自述在采信阶段不是主力。 Shero Commerce 全球分析(2026 年 8 月 26 日)显示:ChatGPT / Perplexity / Google AI Mode 引用的 1,851 个来源里,只有 2.8% 是品牌自有网站,59% 是第三方媒体;AI 点名推荐某品牌时,该品牌官网被引概率只有 31%(完整拆解)。16.7 万次引用的研究给出了更精确的边界:85.7% 的引用指向第三方,但在无品牌指向的事实性问题上,第一方官网引用占比反超 40%证据采购全景)。

合起来是个重要结论:官网在“事实题”上有优势,在“推荐题”上没有。 目标是“AI 推荐我的品牌”的话,只改官网就是半成品。

(5)最容易踩的坑:自夸无效。 Lily Ray 基于 100 个 B2B 查询的实测显示:AI 引用了你家“最佳/对比”类文章时,69% 的情况仍推荐竞对,只有 21% 把你评第一(实测细节)。AI 拿你的自夸当信息源,但不当结论。有效的是可交叉验证的事实——规格参数、价格区间、第三方评测、可查案例。

诊断动作

  1. 做一次品牌实体一致性测试,对照官网、第三方档案、社交主页三处口径。
  2. 抽 5 个高价值页面,检查是否有 Product / TechArticle / Article 级语义标注。
  3. 抽 10 个页面里的数字,统计有几个带来源与时间。
  4. 数过去 90 天第三方提到你品牌的次数——是提及,不是外链

四、第三关:摘得走——信你,但你的段落没法直接用

这是最容易被跳过的一关:它不影响“能不能被引用”,只影响“被引成什么”。

先建立一个关键认知:引用是段落级的。 Google 开发者文档说明,Gemini grounding 的响应里 groundingMetadata 会把每个声明(segment)精确关联到来源段落(groundingChunks)——颗粒度是“段落对段落”,不是“网页对网页”;Anthropic 的 Citations API 同样是逐句引用。判据因此只有一条:把这一段单独摘出来、放进完全不同的上下文里,它还成立吗?

高引用率的内容形态例子为什么好摘
定义句“GEO 是……”主语加判断完整,不依赖上下文
对比表格一行一个维度天然是“事实的容器”,可整块搬走
步骤列表1 / 2 / 3 顺序动作可被整段复述为操作方法
带口径的数字句数字 + 来源 + 时间可直接采信,无需再核

这一关的可控性也是三关里最高的。7,387 次引用的实测显示:产品页以 24.1% 成为最大单一来源;“对比”类提示词只占 20%,却贡献约 27% 的引用(约 1.33 倍超额回报);88.3% 的引用落在品牌可控内容上页型分布完整数据)。引用的大头来自你自己能改的页面——这是三关里唯一由你说了算的一关。

负面清单(这些都是段落摘不走的原因)

  • 用代词开头:“这一点”“如上所述”“前者”——脱离上下文就失去主语。
  • 结论埋在第 5 段——行业实测口径显示约 44% 的引用来自页面前 30% 的内容。
  • 规格、参数、价格只存在于图片或 PDF 里,正文找不到一句可摘的陈述。
  • 一个 H2 底下挂 800 字不分段,模型无从判断该摘哪一句。

诊断动作

从高价值页面里随机抽 10 段,遮住上下文,逐段问:这段讲的是谁?讲的是什么?凭什么是真的? 有一问答不上来,这段就摘不走。写作层面的完整细则见 GEO 时代的内容策略


五、为什么“ChatGPT 不引用我的网站”——按引擎拆开看

“不引用”的原因,各引擎并不相同。官方机制已经公开的部分,可以省掉大量猜测:

引擎检索通道(官方口径)“不引用你”的最常见原因优先动作
ChatGPTOAI-SearchBot 负责搜索收录与摘要;GPTBot 只影响训练页面没被 OAI-SearchBot 抓到;或属采购决策类问题,答案优先走平台数据层先确认 robots 放行 OAI-SearchBot,再查收录
Google AI Overviews / AI Mode与经典搜索共用同一个索引,不存在独立的 AI 排名索引内有,但语义与实体不足;或某个子查询没有对应段落补语义标注与实体,用 GSC 报告看曝光
Perplexity自建爬虫,引用密度在主流引擎中最高社交源出清后(YouTube -88%、TikTok -72%),引用转向第一方与权威第三方把产品页与文档页做成可摘录的事实页
国内(豆包 / DeepSeek)豆包走字节自建信源池;DeepSeek 走 Bing 系外部检索两者机制相反,一套打法不通用见站内国内引擎专文

各引擎的官方规则逐项拆解见 六大模型官方规则;国内两个引擎的机制差异见 豆包 + DeepSeek 双引擎拆解

这里有一个必须纠正的预期:Google 官方明确说明,AI Overviews 和 AI Mode 与经典搜索共用同一个索引,不存在第二套“AI 排名”。 所以“AI 优化”不是另起一套排名体系,而是在同一索引上追加三个条件——放行、可读懂、可摘录。


六、被引用了,但没人记住你:先排除“幽灵引用”

如果你已经在引用列表里,咨询量却没有变化,问题可能不在“没被引用”,而在被引用了但品牌没被记住:62%–73% 的 AI 引用在用户视角里看不到品牌,你的内容在为 AI 打工(成因与修复路径)。修复方向是品牌锚定——让可被摘走的那句话里,主语是你的品牌,而不是“业内普遍认为”。

反向的假象同样常见:引用率骤降不一定是你的问题。 AI Mode 的底层模型已进入“三周一换”的节奏,不记录模型版本,你会把换代噪声当成事故处理(观测方法)。


七、引用率怎么测:三个必须分开记的字段

GEO 优化怎么做 讲过测量框架(提及率、引用率、推荐率三套指标分开看),这里只补“引用率”这一个指标自己怎么测。固定 Prompt 测试集要能测出引用,每次记录必须包含三个字段:

字段为什么要记常见错法
引用的具体 URL“品牌被提到”是推荐,“页面被引用”才是引用只记“有没有提到我”
引擎 + 模型版本引用率波动绝大多数来自模型换代,不标版本无法归因只写“ChatGPT”
日期与问题原文单次结果没有解释力,只有趋势有用一次抽查下结论

数据源的边界也要清楚:Google 已于 2026 年 8 月 31 日向全球开放 Search Console 的生成式 AI 性能报告,但它只给曝光、不给点击,退出控制还是资源级一刀切——拿它当排名报表看,一定会误判(口径与边界)。


八、30 天行动清单

今天做

  • 把品牌名单独丢给 ChatGPT 等引擎问“这是谁”,核对描述与官网定位是否一致
  • 挑 3 个你确定自己该赢的事实性问题各测一遍,记录引用 URL、引擎与模型版本、日期

本周做

  • 拉一周服务器日志,按 AI 爬虫 UA 统计状态码,找出 403 / 429 / 超时
  • 逐类确认 robots.txt 放行策略,训练型与检索型分开决定
  • 抽 10 个高价值页面做“段落独立成立”测试,标出摘不走的段落

本月做

  • 补齐核心页面的 Product / TechArticle / Article 级语义标注,输出覆盖清单
  • 把 3–5 个产品页与对比页改造成可摘录事实页:结论前置、补对比表、数字带来源与时间
  • 建立第三方提及计划,把“被推荐”的证据来源从官网扩到第三方
  • 固定 Prompt 测试集按周复测,三个字段分开记录

结语:卡在哪一关,就在哪一关投入

如何让 AI 引用我的网站?把问题拆开就不玄学了:先确认引擎在这一轮提问里能不能看到你,再确认它敢不敢拿你当证据,最后确认你的段落能不能被整段摘走。

三关里最反直觉的一条是:绝大多数网站早就过了第一关,却一直在第三关使劲。 内容改了一轮又一轮,实体没对齐、语义没标注、第三方没有一句关于你的话——改到最后,AI 依然不知道你是谁。

先定位断点,再投入动作,是这件事上唯一能省下大笔预算的做法。


📩 需要帮助?GEO 咨询团队可以为你做什么

想知道自己卡在哪一关,可以按这个顺序往下走:

第一步 · 先自己看 —— 用免费工具 30 秒检测你的网站是否具备 AI 搜索可见度基础(AI 爬虫访问、结构化数据、内容可读性三项):GEO 诊断工具 →

第二步 · 再找人诊断 —— 如果你需要的是一次逐关定位、拿到按优先级排序的修复清单:GEO 审计与 AI 搜索诊断 →;确认方向后要持续优化:GEO 优化服务 →


本文为方法说明类内容。文中引用的数据均来自站内已发布报道的公开来源,并已在对应位置给出内链;涉及各 AI 引擎机制的部分以官方文档口径为准。AI 搜索产品的机制与命名变化较快,本文结论截至 2026 年 9 月。