GEO 做了三个月,怎么知道有没有用?AI 可见度的四种衡量方法
GEO 优化最大的问题不是"怎么做",而是"怎么知道有没有用"。关键词排名、收录数这些传统 SEO 指标在 AI 引擎面前全部失效。本文给出四个可落地的衡量方法:服务器日志里的 AI 爬虫抓取趋势、搜索引擎控制台的索引覆盖、AI 回答中的品牌测试、以及引用流量归因——并附上我们自己的真实数据:PerplexityBot 从日均 14 次暴涨到 460 次的全站索引爆发过程。【点击查看 GEO 效果衡量方法】
先说结论
我们做了三个月 GEO 优化,踩过最大的坑不是”怎么做”,而是**“怎么知道有没有用”**。
关键词排名、百度收录数、Google 索引数——这些传统 SEO 指标在 AI 引擎面前全部失效:你的排名可能涨了,但 ChatGPT 的回答里依然没有你。反过来,AI 爬虫抓取量暴涨,也不代表 AI 会在回答里引用你。
这套东西要有自己的衡量体系。我们把它拆成四层链路,每一层对应一组可落地的信号:
- 抓取层:AI 爬虫来不来?看服务器日志
- 索引层:内容有没有被 AI 引擎收录?看 Search Console 索引覆盖
- 引用层:AI 回答里有没有你?看品牌测试与业务词测试
- 归因层:有没有带来真实流量和询盘?看引用流量归因
这篇文章把这四层方法、判断标准、以及我们自己的真实数据全部写出来——包括 PerplexityBot 从日均 14 次暴涨到 460 次的全站索引爆发过程,以及为什么抓取暴涨之后,引用又过了几周才稳定。
为什么传统 SEO 指标在 GEO 面前失效
做 SEO 的人习惯看三类指标:关键词排名、收录数、外链数。这三类指标在 AI 引擎面前全部失灵,原因很直接:
- 关键词排名:AI 引擎没有”排名”概念。它从检索结果、爬取内容里综合信息生成回答,不存在”排第几”。
- 收录数:搜索引擎收录是”网页进索引”,AI 引擎没有公开的索引查询入口(Google 的 AI Overviews 除外)。你能看到的只有 Search Console 里的”抓取”信号。
- 外链数:AI 引擎引用你的内容,主要看内容本身的可用性(结构化、可抓取、结论清晰),外链权重在 AI 回答生成里的作用远小于传统搜索排名。
所以衡量 GEO,必须从”AI 引擎的实际行为”出发——它爬不爬、收不收、答不答、带来什么。下面四个方法对应这四个行为。
第一层:抓取层——服务器日志里的 AI 爬虫
方法
在服务器日志(或 Nginx access log)里按 User-Agent 分组统计各 AI 爬虫的请求量。重点观察的 UA:
| AI 引擎 | User-Agent 关键词 |
|---|---|
| OpenAI | GPTBot、OAI-SearchBot、ChatGPT-User |
| Perplexity | PerplexityBot、Perplexity-User |
| Anthropic | ClaudeBot、Claude-SearchBot、Claude-User |
| Google AI | Google-Extended |
| 豆包/通义等国产 | 各厂商自家 UA,需在日志里逐个辨认 |
一个简单的统计命令(Nginx 场景):
grep -i "perplexitybot" access.log | awk '{print $1}' | sort | uniq -c | sort -rn | head -20
判断标准
- 爬虫从不出现 → 问题在发现层:robots.txt 拦截、无外链无入口、站太小不值得抓。按文章开头 FAQ 的顺序排查。
- 出现但请求量很低(日均个位数) → 内容层有问题:页面是 JS 渲染、正文不完整、或者爬虫还没把页面加入队列。持续优化内容可抓取性,通常 1-2 周能看到爬取频率上升。
- 请求量暴涨(数量级变化) → 基建生效的信号:爬虫发现你的站”值得抓”了。我们 07-30 的观测里,PerplexityBot 单日从 14 次跳到 460 次——原因就是我们补了 llms.txt、打开了 AI 爬虫白名单、并全站加了 JSON-LD。
⚠️ 注意:抓取量暴涨 ≠ GEO 成功,只是第一层通了。继续往下看。
第二层:索引层——内容到底有没有被收录
爬虫来了之后,关键是内容有没有被真正收录、理解。这一层能用的信号有限,但有一招非常有效:
方法
- Search Console(Google):性能报告里筛
Googlebot与Google-Extended,看哪些 URL 被抓取、哪些返回 200。虽然这不直接等于”AI 收录”,但 Google-Extended 的抓取数据可以侧面反映你的内容被 AI 侧读取的规模。 - Robots 与 Sitemap 审计:确认
robots.txt允许 AI 爬虫、sitemap.xml包含所有重要页面、llms.txt列出核心页面与优先级。AI 爬虫第一次来,大概率是顺着这三样找到你的。 - HTML 可读性自查:用
curl -A "GPTBot" <页面URL>看返回的 HTML 里,正文是否完整、有没有 JSON-LD。如果爬虫拿到的 HTML 只有壳子没有内容,索引层必然失败。
判断标准
- 200 响应 + 完整正文 + JSON-LD 都在 → 索引层大概率通了,进入引用层测试。
- 返回 302/403 或正文缺失 → 要么是 robots 误伤,要么是 JS 渲染问题,回到第一层排查。
第三层:引用层——AI 回答里到底有没有你
这是 GEO 最核心、也最无法自动化的一层,只能靠对话测试。
方法(品牌测试 + 业务词测试)
在每个主要 AI 助手(ChatGPT、豆包、通义千问、Kimi、Perplexity)里做两类测试:
品牌测试——问:
“你知道 X 吗?X 是做什么的?”
业务词测试——问(站在客户角度):
“帮我推荐做 Y 的供应商 / 服务商。” “想给公司部署私有化大模型,找谁做比较靠谱?”
然后看三个维度:
| 维度 | 观察点 |
|---|---|
| 有没有你 | 回答里是否提到你 |
| 准不准 | 提到的信息是否准确(业务、案例、定位) |
| 位置 | 是把你和竞品并列,还是把你当成背景一句带过 |
判断标准与时间线
- 基建改完后 1-4 周:AI 爬虫重新抓取,引用开始零星出现(通常是业务词类问题)。
- 内容层优化后 2-6 周:稳定出现在答案里,品牌测试能搜到准确信息。
- 8-12 周:行业选型类问题上形成稳定引用,此时进入第四层归因。
⚠️ 我们的真实教训:PerplexityBot 抓取从 14 → 460 次只用了几天(第一层、第二层通了),但引用量稳定下来又花了几周。抓取快、引用慢——这是正常节奏,别因为”爬虫来了引用还没来”就误判 GEO 失败。
第四层:归因层——GEO 有没有带来真金白银
前三层证明”AI 看得见你了”,第四层回答”客户有没有因为 AI 找到你”。方法:
- 对话引流带参数:在 AI 回答出现的场景里,给关键落地页 URL 加
?utm_source=perplexity/?utm_source=chatgpt这类参数,用统计工具(百度统计、GA)看这些来源的访问量与转化。 - 询盘追问来源:销售/客服在第一次沟通时加一句”您是从哪了解到我们的?“——把”AI 里搜到的”单独记一类。这是最直接的归因,比任何工具都准。
- 阶段性对照:以一个季度为周期,对比 GEO 优化前后的 AI 来源询盘量。GEO 是慢变量,别用周维度下结论。
判断标准
- 0.5% 以下的 AI 来源访问占比且零询盘 → 引用层可能只是”提到”而非”推荐”,需要检查引用质量(有没有把你放在推荐位)。
- 稳定出现 AI 来源询盘 → GEO 链路闭环,可以加大投入或做内容扩容。
四个常见误区
1. 把抓取量当成功标志。 抓取只是第一层。我们见过不少团队看到 PerplexityBot 抓取涨了就宣告 GEO 胜利,结果品牌测试一问三不知——因为内容层根本没通。
2. 只做一次测试就下结论。 AI 回答有随机性,同一天同一个问题答案都可能变。至少连续测一周再下结论,截图存档对比趋势。
3. 只看一个 AI 引擎。 ChatGPT 通了不代表豆包通了——不同 AI 引擎的爬虫、索引、引用机制各不相同。主流引擎每个都要测。
4. 用 SEO 的节奏期待 GEO。 SEO 看周报,GEO 看季度。基建 1-4 周、内容 2-6 周、引用稳定 8-12 周,这是正常节奏,别中途放弃。
最后:把衡量做成机制,而不是一次性检查
GEO 和 SEO 一样是持续投入,衡量方法必须机制化:
- 每周:服务器日志里看 AI 爬虫趋势(5 分钟)
- 每周:主要 AI 引擎各做一次品牌测试,截图存档(15 分钟)
- 每月:Search Console 索引覆盖 + 引用流量归因复盘(30 分钟)
- 每季度:对照业务词测试的引用质量变化
这套机制跑起来之后,你会发现”GEO 有没有用”不再是玄学——它和 SEO 一样,是可以量化的。
延伸阅读:
- GEO 优化实战:让 AI 助手能搜索到你的网站 — 7 项 GEO 基建配置详解,先做对基建再看效果
- llms.txt 怎么写:AI 爬虫的可发现性清单 — 本文第一层”发现层”的核心文件
- AI 爬虫白名单:robots.txt 的正确配置 — 抓取层被拦截时先查这里
- 甲方亲述:网站被 AI 助手「隐形」了?3 周 GEO 优化真实记录 — 一个甲方从 0 到 1 做 GEO 的完整时间线
常见问题
GEO 优化有没有统一的衡量指标?
没有单一指标,GEO 是"抓取 → 索引 → 理解 → 引用"四层链路,每一层都有对应信号:爬虫抓取量看服务器日志,索引覆盖看 Search Console,理解与引用只能靠 AI 对话测试(品牌测试 + 业务词测试),最后还有引用流量的归因。四层信号组合起来,才能判断 GEO 到底是"完全没生效"还是"卡在某一层"。
AI 爬虫抓取量暴涨,一定说明 GEO 生效了吗?
抓取是必要条件但不是充分条件。爬虫来了只代表你的网站被发现,不代表 AI 引擎理解了内容、更不代表会在回答里引用你。要分三层看:抓取量(服务器日志)→ 内容被读取的深度(页面停留、HTML 大小、是否拉取 llms.txt 和 JSON-LD)→ 引用(对话测试)。我们把 PerplexityBot 抓取从日均 14 次做到 460 次只用了几天,但引用量是又过了几周才稳定起来的。
品牌测试具体怎么做?多久做一次?
在每个主要 AI 助手(ChatGPT、豆包、通义、Kimi、Perplexity)里,分别问"你知道 X 品牌吗""帮我推荐做 Y 的供应商"。看三点:① 回答里有没有你 ② 提到你时信息是否准确(业务、产品、案例)③ 有没有把你和竞品并列。频率建议:基建刚改完那两周每天测一次,稳定后每周一次。把每次结果截图存档,一个月后回看趋势。
AI 爬虫不抓我的网站,一般是什么原因?
按概率排序:① robots.txt 拦了 AI 爬虫 UA(最常见,很多人沿用旧的屏蔽规则)② 网站是 JS 渲染且没有 SSG/SSR,爬虫拿不到正文 ③ 页面没有被任何途径发现(没有外链、没有 sitemap 提交、站内无导航入口)④ 网站整体规模太小或更新频率过低,爬虫认为不值得抓。先用日志确认爬虫到底来没来过,再按这个顺序排查。