← 返回博客

GEO 做了三个月,怎么知道有没有用?AI 可见度的四种衡量方法

GEO 优化最大的问题不是"怎么做",而是"怎么知道有没有用"。关键词排名、收录数这些传统 SEO 指标在 AI 引擎面前全部失效。本文给出四个可落地的衡量方法:服务器日志里的 AI 爬虫抓取趋势、搜索引擎控制台的索引覆盖、AI 回答中的品牌测试、以及引用流量归因——并附上我们自己的真实数据:PerplexityBot 从日均 14 次暴涨到 460 次的全站索引爆发过程。【点击查看 GEO 效果衡量方法】

先说结论

我们做了三个月 GEO 优化,踩过最大的坑不是”怎么做”,而是**“怎么知道有没有用”**。

关键词排名、百度收录数、Google 索引数——这些传统 SEO 指标在 AI 引擎面前全部失效:你的排名可能涨了,但 ChatGPT 的回答里依然没有你。反过来,AI 爬虫抓取量暴涨,也不代表 AI 会在回答里引用你。

这套东西要有自己的衡量体系。我们把它拆成四层链路,每一层对应一组可落地的信号

  1. 抓取层:AI 爬虫来不来?看服务器日志
  2. 索引层:内容有没有被 AI 引擎收录?看 Search Console 索引覆盖
  3. 引用层:AI 回答里有没有你?看品牌测试与业务词测试
  4. 归因层:有没有带来真实流量和询盘?看引用流量归因

这篇文章把这四层方法、判断标准、以及我们自己的真实数据全部写出来——包括 PerplexityBot 从日均 14 次暴涨到 460 次的全站索引爆发过程,以及为什么抓取暴涨之后,引用又过了几周才稳定。


为什么传统 SEO 指标在 GEO 面前失效

做 SEO 的人习惯看三类指标:关键词排名、收录数、外链数。这三类指标在 AI 引擎面前全部失灵,原因很直接:

  • 关键词排名:AI 引擎没有”排名”概念。它从检索结果、爬取内容里综合信息生成回答,不存在”排第几”。
  • 收录数:搜索引擎收录是”网页进索引”,AI 引擎没有公开的索引查询入口(Google 的 AI Overviews 除外)。你能看到的只有 Search Console 里的”抓取”信号。
  • 外链数:AI 引擎引用你的内容,主要看内容本身的可用性(结构化、可抓取、结论清晰),外链权重在 AI 回答生成里的作用远小于传统搜索排名。

所以衡量 GEO,必须从”AI 引擎的实际行为”出发——它爬不爬、收不收、答不答、带来什么。下面四个方法对应这四个行为。


第一层:抓取层——服务器日志里的 AI 爬虫

方法

在服务器日志(或 Nginx access log)里按 User-Agent 分组统计各 AI 爬虫的请求量。重点观察的 UA:

AI 引擎User-Agent 关键词
OpenAIGPTBot、OAI-SearchBot、ChatGPT-User
PerplexityPerplexityBot、Perplexity-User
AnthropicClaudeBot、Claude-SearchBot、Claude-User
Google AIGoogle-Extended
豆包/通义等国产各厂商自家 UA,需在日志里逐个辨认

一个简单的统计命令(Nginx 场景):

grep -i "perplexitybot" access.log | awk '{print $1}' | sort | uniq -c | sort -rn | head -20

判断标准

  • 爬虫从不出现 → 问题在发现层:robots.txt 拦截、无外链无入口、站太小不值得抓。按文章开头 FAQ 的顺序排查。
  • 出现但请求量很低(日均个位数) → 内容层有问题:页面是 JS 渲染、正文不完整、或者爬虫还没把页面加入队列。持续优化内容可抓取性,通常 1-2 周能看到爬取频率上升。
  • 请求量暴涨(数量级变化) → 基建生效的信号:爬虫发现你的站”值得抓”了。我们 07-30 的观测里,PerplexityBot 单日从 14 次跳到 460 次——原因就是我们补了 llms.txt、打开了 AI 爬虫白名单、并全站加了 JSON-LD。

⚠️ 注意:抓取量暴涨 ≠ GEO 成功,只是第一层通了。继续往下看。


第二层:索引层——内容到底有没有被收录

爬虫来了之后,关键是内容有没有被真正收录、理解。这一层能用的信号有限,但有一招非常有效:

方法

  1. Search Console(Google):性能报告里筛 GooglebotGoogle-Extended,看哪些 URL 被抓取、哪些返回 200。虽然这不直接等于”AI 收录”,但 Google-Extended 的抓取数据可以侧面反映你的内容被 AI 侧读取的规模。
  2. Robots 与 Sitemap 审计:确认 robots.txt 允许 AI 爬虫、sitemap.xml 包含所有重要页面、llms.txt 列出核心页面与优先级。AI 爬虫第一次来,大概率是顺着这三样找到你的。
  3. HTML 可读性自查:用 curl -A "GPTBot" <页面URL> 看返回的 HTML 里,正文是否完整、有没有 JSON-LD。如果爬虫拿到的 HTML 只有壳子没有内容,索引层必然失败。

判断标准

  • 200 响应 + 完整正文 + JSON-LD 都在 → 索引层大概率通了,进入引用层测试。
  • 返回 302/403 或正文缺失 → 要么是 robots 误伤,要么是 JS 渲染问题,回到第一层排查。

第三层:引用层——AI 回答里到底有没有你

这是 GEO 最核心、也最无法自动化的一层,只能靠对话测试

方法(品牌测试 + 业务词测试)

在每个主要 AI 助手(ChatGPT、豆包、通义千问、Kimi、Perplexity)里做两类测试:

品牌测试——问:

“你知道 X 吗?X 是做什么的?”

业务词测试——问(站在客户角度):

“帮我推荐做 Y 的供应商 / 服务商。” “想给公司部署私有化大模型,找谁做比较靠谱?”

然后看三个维度:

维度观察点
有没有你回答里是否提到你
准不准提到的信息是否准确(业务、案例、定位)
位置是把你和竞品并列,还是把你当成背景一句带过

判断标准与时间线

  • 基建改完后 1-4 周:AI 爬虫重新抓取,引用开始零星出现(通常是业务词类问题)。
  • 内容层优化后 2-6 周:稳定出现在答案里,品牌测试能搜到准确信息。
  • 8-12 周:行业选型类问题上形成稳定引用,此时进入第四层归因。

⚠️ 我们的真实教训:PerplexityBot 抓取从 14 → 460 次只用了几天(第一层、第二层通了),但引用量稳定下来又花了几周。抓取快、引用慢——这是正常节奏,别因为”爬虫来了引用还没来”就误判 GEO 失败。


第四层:归因层——GEO 有没有带来真金白银

前三层证明”AI 看得见你了”,第四层回答”客户有没有因为 AI 找到你”。方法:

  1. 对话引流带参数:在 AI 回答出现的场景里,给关键落地页 URL 加 ?utm_source=perplexity / ?utm_source=chatgpt 这类参数,用统计工具(百度统计、GA)看这些来源的访问量与转化。
  2. 询盘追问来源:销售/客服在第一次沟通时加一句”您是从哪了解到我们的?“——把”AI 里搜到的”单独记一类。这是最直接的归因,比任何工具都准。
  3. 阶段性对照:以一个季度为周期,对比 GEO 优化前后的 AI 来源询盘量。GEO 是慢变量,别用周维度下结论。

判断标准

  • 0.5% 以下的 AI 来源访问占比且零询盘 → 引用层可能只是”提到”而非”推荐”,需要检查引用质量(有没有把你放在推荐位)。
  • 稳定出现 AI 来源询盘 → GEO 链路闭环,可以加大投入或做内容扩容。

四个常见误区

1. 把抓取量当成功标志。 抓取只是第一层。我们见过不少团队看到 PerplexityBot 抓取涨了就宣告 GEO 胜利,结果品牌测试一问三不知——因为内容层根本没通。

2. 只做一次测试就下结论。 AI 回答有随机性,同一天同一个问题答案都可能变。至少连续测一周再下结论,截图存档对比趋势。

3. 只看一个 AI 引擎。 ChatGPT 通了不代表豆包通了——不同 AI 引擎的爬虫、索引、引用机制各不相同。主流引擎每个都要测。

4. 用 SEO 的节奏期待 GEO。 SEO 看周报,GEO 看季度。基建 1-4 周、内容 2-6 周、引用稳定 8-12 周,这是正常节奏,别中途放弃。


最后:把衡量做成机制,而不是一次性检查

GEO 和 SEO 一样是持续投入,衡量方法必须机制化

  • 每周:服务器日志里看 AI 爬虫趋势(5 分钟)
  • 每周:主要 AI 引擎各做一次品牌测试,截图存档(15 分钟)
  • 每月:Search Console 索引覆盖 + 引用流量归因复盘(30 分钟)
  • 每季度:对照业务词测试的引用质量变化

这套机制跑起来之后,你会发现”GEO 有没有用”不再是玄学——它和 SEO 一样,是可以量化的。

延伸阅读:

常见问题

GEO 优化有没有统一的衡量指标?

没有单一指标,GEO 是"抓取 → 索引 → 理解 → 引用"四层链路,每一层都有对应信号:爬虫抓取量看服务器日志,索引覆盖看 Search Console,理解与引用只能靠 AI 对话测试(品牌测试 + 业务词测试),最后还有引用流量的归因。四层信号组合起来,才能判断 GEO 到底是"完全没生效"还是"卡在某一层"。

AI 爬虫抓取量暴涨,一定说明 GEO 生效了吗?

抓取是必要条件但不是充分条件。爬虫来了只代表你的网站被发现,不代表 AI 引擎理解了内容、更不代表会在回答里引用你。要分三层看:抓取量(服务器日志)→ 内容被读取的深度(页面停留、HTML 大小、是否拉取 llms.txt 和 JSON-LD)→ 引用(对话测试)。我们把 PerplexityBot 抓取从日均 14 次做到 460 次只用了几天,但引用量是又过了几周才稳定起来的。

品牌测试具体怎么做?多久做一次?

在每个主要 AI 助手(ChatGPT、豆包、通义、Kimi、Perplexity)里,分别问"你知道 X 品牌吗""帮我推荐做 Y 的供应商"。看三点:① 回答里有没有你 ② 提到你时信息是否准确(业务、产品、案例)③ 有没有把你和竞品并列。频率建议:基建刚改完那两周每天测一次,稳定后每周一次。把每次结果截图存档,一个月后回看趋势。

AI 爬虫不抓我的网站,一般是什么原因?

按概率排序:① robots.txt 拦了 AI 爬虫 UA(最常见,很多人沿用旧的屏蔽规则)② 网站是 JS 渲染且没有 SSG/SSR,爬虫拿不到正文 ③ 页面没有被任何途径发现(没有外链、没有 sitemap 提交、站内无导航入口)④ 网站整体规模太小或更新频率过低,爬虫认为不值得抓。先用日志确认爬虫到底来没来过,再按这个顺序排查。

本文来自 AI Enable Harness 一线交付实践。需要同类系统或优化服务?

订阅博客更新

新文章发布后第一时间邮件通知。不定期发送,不推销。

订阅 →