行业动态 2026年9月2日

50 站实测:AI 就绪度三层断层,语义标注层平均仅 38.5%

SEJ 用带探针浏览器实测 50 个大站的 AI 就绪度:可抓取层平均 74.4%,语义标注层跌到 38.5%,智能体交易层仅 2.1%——机器可读性才是 AI 引用的硬门槛。同周 DMA 公布 Google 欧洲搜索数据许可时间表,竞对 AI 引擎 11 月将拿到真实点击数据;行业 KPI 同步换锚为提及频率。附三层行动清单。

#GEO #AI搜索 #结构化数据 #Schema #DMA #2026趋势

TL;DR / 核心要点总结

  • AI 就绪度第一次有了量化横切面:SEJ 用带探针的浏览器真实抓取 50 个大网站(6 月 12 日实测),按”Agentic Readiness”框架打分——可抓取层平均 74.4% 及格,语义标注与归因层只剩 38.5%,智能体交易层只有 2.1%(46/48 站拿零分)。
  • 语义标注是当前全行业最大短板:只有 70% 的主页带 JSON-LD,近 1/3 的站全站零结构化数据。AI 引用你的前提是机器能读懂你——读不懂就猜,猜错是幻觉,猜不中就引用竞品。
  • DMA 第二锤落在数据层:Google 公布欧洲搜索数据许可时间表——9/17 起发许可协议、11/16 数据样本上线,合规授权(非泄漏)。能吃下这批数据的 Perplexity 级竞对 AI 引擎,会把”AI 引用谁”向”用户在 Google 真点了谁”对齐。
  • 度量体系换锚:一周内 Semrush 把 AI 搜索表现纳入 KPI 框架、国内知识库喊出”用提及频率替代排名”、Google 官宣 AdSense 改按 Begin-to-Render 计展示(2027/2/17 生效)——旧指标词典正在被整体废弃。

2026 年 9 月 1 日,Search Engine Journal 发布了一份特殊的”体检报告”:用装着探针的浏览器真实抓取 50 个大网站(Airbnb、eBay 级别的流量体量),按”AI 就绪度”(Agentic Readiness)框架逐层打分。这是 AI 搜索兴起以来,行业第一次拿到量化横切面——结论毫不客气:大部分网站能被 AI 抓到,但几乎没有网站能被 AI 读懂,更没有网站能跟 AI 做生意。

同一天,欧盟 DMA 对 Google 的第二锤也落到了数据层:欧洲搜索数据许可计划公布时间表,竞对 AI 搜索引擎即将拿到 Google 的真实查询与点击数据。两件事合在一起,指向同一个方向——AI 可见性竞争的下半场,拼的是机器可读语义与真实点击信号,不是内容堆量。

一、AI 就绪度三层断层:能抓到 ≠ 能被读懂

SEJ 的审计框架把”网站对 AI 的开放程度”拆成三层,实测结果呈现严重的阶梯式断层:

AI 就绪度层级审计内容50 站平均得分
第一层:可抓取层robots、语义 HTML、SSR、可访问性、sitemap74.4%
第二层:归因与语义层JSON-LD 结构化数据 + Content Signals Policy38.5%
第三层:智能体交易层OAuth 发现协议等,让 AI 能安全调用你的接口、完成交易2.1%

几个触目惊心的细节:只有 70% 的主页部署了 JSON-LD,近 1/3 的站全站找不到任何结构化数据;46/48 个站在第三层拿零分;连 Cloudflare 为 robots.txt 推出的分级指令 Content Signals Policy(可精确区分”索引 / AI 实时回答 / 模型训练”三种用途),50 个站里也只有 5 个部署。

对企业的翻译:这是一份全行业体检报告,结论一句话——AI 引用你的前提是机器能读懂你,而机器可读性现在是最大的短板。第一层(能被抓到)大部分站已及格;第二层(AI 知不知道这个页面讲的是什么产品、什么方法、什么数据)才是分水岭:没有 TechArticle / Product 级语义标注的页面,AI 只能靠猜——猜错就是幻觉,猜不中就去引用竞品。FAQ 富媒体结果已终止(8/28 我们详解过),但 FAQPage 标记别删:它的价值已经转移到”AI 语料”这条线上。第三层 2.1% 短期不用焦虑——智能体交易协议 2025 年底才刚起步——但如果两年内你想让 AI 直接替用户下单或查询 API,现在就要为接口的机器可发现性留出设计余地。

针对这个断层,本月的动作应该落在这三件事:

  • 跑一遍全站 JSON-LD 覆盖清单:用 Lighthouse / 爬虫逐页检查,核心产品页必须有 Product、Article / TechArticle、Organization、Breadcrumb 级语义;带数据表的页面补 Dataset 标注——别让”这是什么”靠 AI 猜(结构化数据怎么写才合规,可对照我们的《结构化数据指南》)。
  • 给 robots.txt 做 AI 分级:别一刀切全放或全禁。研究 Cloudflare Content Signals Policy,或 Google-Extended / GPTBot 分级放行——想被 ChatGPT / Perplexity 引用学术类内容,“训练爬虫”与”实时检索爬虫”的策略要分开定。
  • 顺手自查语义 HTML 与 SSR:首页 / 核心页若是客户端渲染或层级混乱,那是第一层里少数大站也在丢分的点,修完对自然排名与 AI 抓取双受益。

二、DMA 第二锤:AI 竞对引擎将拿到 Google 的真实点击数据

如果说 8/28 的 Site Reputation 政策 EEA 豁免是第一锤,这次 Google 公布的欧洲搜索数据许可计划直接打在数据层。按欧盟 DMA 要求,Google 必须把欧洲经济区内的匿名化查询、点击、排名、浏览数据授权给合格搜索引擎,时间表已出:

  • 9/17:开始发放许可协议;
  • 11/16:数据样本上线——1000 行免费样本、1000 万查询的合成数据集、5% 完整样本,FRAND 条款收费。

门槛不低:须是 DMA 定义下的搜索引擎,且欧盟月活 5 万以上——AI 聊天搜索也算;出版商与 SEO 公司不在范围内。这不是”谷歌数据泄漏”式标题党渲染的泄库,而是合规授权:数据匿名化、接受审计、按 FRAND 定价。

对企业的翻译:能吃下这批数据的是 Perplexity 级别的竞对 AI 引擎。它们会拿 Google 的真实点击与查询数据训练自己的引用排序——“AI 引用哪些站”将开始向”用户在 Google 上真点了哪些站”对齐。这是把双刃剑:你在 Google 点击表现强的页面,未来大概率也是 AI 引擎爱引用的页面,强者恒强;新站冷启动则更难,只能靠差异化的权威信号破局。

建议从现在起做两件低成本的事:一是 9/17–11/16 期间盯哪些 AI 引擎官宣拿到许可,这份名单本身就是行业风向标;二是把自家”Google 点击 Top 页”与”AI 引用 Top 页”做一次重叠度分析——重叠度会随这批数据落地而上升,这正是可以向管理层汇报的 AI 可见性先行指标。

三、度量体系换锚:提及频率替代排名,广告口径同步重写

一周之内三件事指向同一个方向——旧指标词典正在被整体废弃:

  • Semrush(8/31):发布《18 SEO KPIs》,把 AI 搜索表现正式纳入 SEO 绩效框架;
  • 国内 GEO 知识库(8/31):同步喊出”用提及频率替代排名来衡量 AI 搜索表现”;
  • Google(9/1 官宣):AdSense 展示计数从”开始下载”改为”开始渲染”(Begin-to-Render),2027 年 2 月 17 日生效——未真正渲染的广告不再计展示。

前两条是 SEO 行业在为”AI 回答即终点”的世界重新定义 KPI:排名与点击是”通往终点的路上”的指标,而 AI 直接给出答案时,可观测、可优化的是你的品牌被提及多少次、被引用多少回GSC AI 报告只给曝光不给点击,恰好逼着行业在官方曝光口径之外寻找第二个锚点)。第三条则是广告侧的连锁反应——整个数字营销的计数逻辑都在跟着 AI 时代重写。

对企业的翻译:两个实操警示。其一,2027/2/17 之后如果站点挂着 AdSense,RPM 与 CTR 会机械性上升——分子不变、分母变小,那不是流量变好了,跨年对比必须先打口径断点。其二,排名 / 点击这套旧 KPI 失真越来越重,“提及频率 / 引用率”作为新锚点的行业共识正在成型——KPI 换锚的窗口就是现在,等报告结构定型再换就晚了。

四、行动清单:给运营者与站长的三组任务

今天做

  • 用 Lighthouse / 爬虫给核心内容页跑一遍 JSON-LD 覆盖清单,先找出”零结构化数据”的页面

本周做

  • 按三层审计框架(可抓取 → 语义标注 → 智能体接口)给核心页做体检:补 Product / TechArticle / Breadcrumb 级语义,带数据表的页补 Dataset 标注
  • 评估 robots.txt 的 AI 抓取分级:训练爬虫与实时检索爬虫分开定策略(Google-Extended / GPTBot / Content Signals Policy)

本月做

  • 月度 AI 可见性报告换锚:正式纳入”AI 提及次数 / 引用率”字段,与 GSC AI 曝光双轨
  • 广告数据报表标注 2027/2/17 口径断点,防止明年误读 RPM / CTR 波动
  • 从 9/17 起跟踪官宣获得 Google 欧洲数据许可的 AI 引擎名单,并建立”Google 点击 Top 页 × AI 引用 Top 页”重叠度基线

结语:先把”机器能读懂你”这件事补上

近两个月我们反复讲 AI 可见性、引用归因、曝光基线(归因口径的坑,见《AI 搜索进入「算账时代」》)。今天这份 50 站实测给出的启示更朴素:AI 引用你的前提是机器能读懂你。可抓取层 74.4%、语义层 38.5%、交易层 2.1%——三层之间的断层,就是未来一两年大多数网站的成长空间。先做 JSON-LD 覆盖清单,再谈分层放行与指标换锚,顺序不能反。

📩 需要帮助?GEO 咨询团队可以为你做什么

面对本周的变化,我们为 B2B 与专业技术品牌提供:

  • AI 就绪度体检:按”可抓取 → 语义标注 → 智能体接口”三层框架实测你的站点,产出 JSON-LD 覆盖清单与修复优先级
  • 语义标注改造:核心产品页 / 数据页的 Product、TechArticle、Dataset 级标注落地,让 AI 不再靠猜理解你的页面
  • AI 可见性双轨报告:GSC AI 曝光 × 第三方提及频率 / 引用率双轨度量,完成 KPI 换锚与月度汇报模板
  • 点击与引用重叠分析:追踪 Google 数据许可落地影响,量化”真实点击强页”与”AI 引用强页”的重叠度与差距

联系我们,获取免费的 GEO 初步诊断 →


本文基于 2026 年 8 月 31 日–9 月 1 日公开报道(Search Engine Journal、Search Engine Roundtable、Search Engine Land、Semrush、新浪)与行业追踪数据整理,所有分析均基于公开信息与作者团队的行业实践经验。