AI搜索可见度审计:GEO测试实用指南
你做了GEO优化,但真的有效吗?本文教你测试ChatGPT、Perplexity和Google AI Overviews是否真的引用你的内容,以及没被引用时该怎么调整。
你发布了 llms.txt。把确定性答案放在最前面。也加了结构化数据。现在的问题是:这些到底有没有用?
传统 SEO 有 Google Search Console——输入 URL,就能看到展示量、点击、排名。GEO 可没这么简单。没有任何后台能告诉你”这周你的网站被 ChatGPT 引用了 12 次”。你只能手动测试。
这篇指南讲的是怎么用一种实用、可重复的流程来审计你的 AI 搜索可见性。不用付费工具,全靠实测。
为什么手动测试比工具靠谱
2025-2026 年冒出来不少”AI 可见性追踪”工具。大多数就是拿一组固定 query 去跑某个 AI 引擎,然后卖给你一个分数。问题在于:
- 它们测的是少量样本 query,不是你的真实 query
- 它们拿不到个性化 AI 结果
- 它们跟不上模型更新(针对 GPT-4 校准的工具,到 GPT-5 可能就废了)
- 一个月 50-200 美元,而这些数据你自己花 20 分钟就能收集
手动测试慢,但更准确。你用的是受众真实使用的 query,在他们真实使用的平台上,用当前最新模型测试。
五大平台测试
在这五个 AI 搜索平台上测试。每个平台的检索机制、引用格式、受众都不一样:
- ChatGPT(开启联网搜索)——用户量最大,用 Bing 做检索
- Perplexity —— 专注 AI 搜索,来源标注最透明
- Google AI Overviews —— 很多 query 会出现在 Google 搜索结果顶部
- Claude(开启联网搜索)——用户增长快,有自己的检索机制
- Microsoft Copilot —— 企业用户多,基于 Bing
不用每次都测五个。先从 ChatGPT 和 Perplexity 开始——它们最可能引用独立站。如果某些 query 你已经在传统搜索有排名,再加上 Google AI Overviews。
第一步:整理测试 query 列表
别拿随机 query 测。测那些跟你的网站真正相关的。
从 Google Search Console 拉数据。 导出过去 90 天展示量最高的 50 个 query。这些是 Google 已经跟你网站关联起来的 query——AI 引擎大概率也在处理同样的 query。按我们 GSC 指南里说的,按展示量排序,筛出信息型意图的 query(疑问句、“what is”、“how to”)。
加上完整问句格式的 query。 AI 搜索用户习惯打完整的问题,不是关键词碎片。把你的核心关键词改写成问句:
- “keyword research” → “how to do keyword research without paid tools”
- “SEO audit” → “what does a technical SEO audit check”
- “GEO optimization” → “how do I get my website cited by AI search”
加上对比类 query。 AI 引擎很擅长处理对比问题,而且被对比文章引用能给品牌带来曝光:
- “what’s the best free SEO tool for indie developers”
- “Ahrefs vs free alternatives for keyword research”
- “ZensInk vs paid SEO tools”
目标准备 20-30 个测试 query,覆盖你的核心主题。
第二步:执行测试
每个 query,就用普通用户的输入方式,原样打进 AI 搜索引擎。记录:
- 是否被引用?(是/否)——你的网站有没有作为来源出现?
- 引用位置 —— 第一个被引用?第二个?第五个?
- 引用的原文 —— AI 从你的内容里摘了什么?
- 竞争对手引用情况 —— 还有哪些网站被引用了?
ChatGPT 测试:
Type your query in ChatGPT with web search enabled.
Look for source citations (numbered references or inline links).
Record results.
Perplexity 测试:
Type your query in Perplexity.
Check the "Sources" section below the answer.
Perplexity shows all sources — easy to scan.
Google AI Overviews 测试:
Search your query on Google.
Look for the AI Overview block at the top.
Check if your site is cited (click "more" to expand sources).
小技巧: 用无痕/隐私模式测试,减少个性化偏差。每个 query 在不同天跑 2-3 次——AI 的回答每次都会不一样。
第三步:给你的可见性打分
建一个简单的评分体系:
引用率: 你的测试 query 里有多大比例引用了你的网站?比如:25 个 query 里有 6 个引用了 = 24% 引用率。
引用位置: 被引用时,你在所有来源里排第几?第一个来源最好——用户点得最多。
平台覆盖: 你在 ChatGPT 上有引用但 Perplexity 没有?或者 Google AI Overviews 有但 ChatGPT 没有?平台之间的差距能告诉你该重点发力哪里。
对标基准: 用竞争对手的品牌名跑同样的 query。如果你没被引用的 query 竞争对手被引用了,分析原因——是他们的内容结构更清晰?还是回答更直接?
第四步:分析为什么没被引用
如果没被引用,问题基本可以归为三类:
第一类:未被抓取(索引问题)
AI 引擎还没发现你的内容。这是个传统 SEO 问题——如果 Google 找不到你的页面,AI 搜索引擎同样找不到。
检查:
- 页面在 Google Search Console 里有没有被索引?
- URL 在不在你的 sitemap 里?
- 页面有没有被 robots.txt 或 noindex 屏蔽?
- 有没有内部链接指向这个页面?内部链接是包括 AI 在内所有爬虫发现内容的途径。
修复: 确保页面可被抓取、被索引,并且网站里至少 3 个其他页面链接到它。
第二类:被抓取但没被选中(内容问题)
AI 找到了你的页面,但选了竞争对手的内容。这说明你的内容存在,但不是最适合被摘录的答案。
检查:
- 你的页面是开头就给出答案,还是把答案埋在第八段?
- 有没有结构化数据(表格、列表、schema)?
- 内容适不适合被引用——有清晰、明确、自洽的表述吗?
- 内容是原创的,还是在改述竞争对手已经说过的话?
修复: 用 BLUF 结构重写关键部分。加上数据表格。让结论有来源可查证。这些优化同样能提升传统 SEO 排名。
第三类:被使用了但没被引用(模型问题)
AI 可能用了你的内容,但没引用。这种情况更难发现,也更难修复。这是模型行为问题,不是内容问题。
检查:
- AI 的回答里有没有包含只有你网站才有的信息(原创数据、独家研究)?
- AI 有没有改述你的原话但没给链接?
修复: 被用了但不被引用,没有可靠的修复办法。最好的防御是发布足够独特的原创数据和分析,让任何准确回答都必须引用你。内容越独特,AI 引擎越可能引用而不是改述。
第五步:追踪 AI 推荐流量
手动测试展示的是引用率,而统计工具展示的是实际流量影响。
在 Google Analytics 4 里:
- 进入 Reports → Acquisition → Traffic Acquisition
- 按 source/medium 筛选,包含:
chatgpt、perplexity、copilot、you.com、claude.ai - 建一个用于 AI 推荐流量的自定义细分(custom segment)
在 Umami 或 Plausible 里:
- 按 AI 域名筛选 referrer URL
- 追踪月度环比增长
对大多数网站来说,AI 推荐流量还很小——占总流量的个位数百分比。但增长很快。GEO 优化做得好的网站,AI 推荐流量每个季度都在翻倍。
重要: 别指望 AI 推荐流量和引用率对得上。很多用户看了 AI 的回答(里面引用了你),但不会点进来。被引用的价值在于品牌曝光和权威性,不只是点击量。
第六步:建立可重复的审计节奏
GEO 测试不是一次性的事。AI 模型频繁更新,引用行为会变,竞争对手也在不断发新内容。
每月审计(30 分钟):
- 在 ChatGPT 和 Perplexity 上重跑你的前 10 个 query
- 查看 AI 推荐流量趋势
- 留意有没有新的竞争对手出现在引用里
每季度审计(2 小时):
- 在全部 5 个平台上跑完整的 20-30 个 query 列表
- 重新计算引用率、位置和覆盖
- 根据最新的 GSC 数据更新测试 query 列表
- 和上一季度的得分做对比
重大模型更新之后:
- 每次 GPT/Claude/Gemini 大版本更新后的 48 小时内测试
- 模型一变,引用模式可能会剧烈变化
什么样的结果算好
基于对多个网站的测试,以下是一个 GEO 优化做得不错的网站能达到的现实基准:
| 指标 | 入门 | 中级 | 高级 |
|---|---|---|---|
| 引用率(你的 query) | 0-10% | 15-30% | 35%+ |
| 平均引用位置 | 未被引用 | 第 3-5 个来源 | 第 1-2 个来源 |
| 有引用的平台数 | 0-1 | 2-3 | 4-5 |
| AI 推荐流量/月 | 0-10 次访问 | 50-200 次访问 | 500+ 次访问 |
| 引用稳定性 | 随机 | 逐步提升 | 跨模型更新稳定 |
这些数字还是早期基准。随着 AI 搜索的发展,预期也会水涨船高。
常见坑
测试 query 太少。 只测 5 个 query 说明不了任何问题——AI 的回答本身噪音就很大。至少测 20 个 query,多跑几次,再下结论。
忽视 Google AI Overviews。 很多开发者盯着 ChatGPT 和 Perplexity,却忽略了 Google AI Overviews。Google 的 AI 回答出现在传统搜索结果上方,触达的受众最多。如果你的某个 query 排在 Google 前 10,你就有机会被 AI Overview 引用。
把提及当成引用。 如果 ChatGPT 在回答里提到了你的品牌名,但没有链接到你的网站,那只是品牌曝光——不是 GEO 成功。两者都追踪,但优先争取带链接的实际引用。
放弃太早。 GEO 比 SEO 更年轻,噪音也更大。第一个月零引用的网站,到第三个月可能就有 15% 的引用率——随着内容被索引、模型不断学习。坚持比早期结果更重要。
常见问题
我应该多久测一次 AI 搜索可见性?
每月做一次快速检查(前 10 个 query,ChatGPT + Perplexity),每季度做一次完整审计(全部 query,全部平台)。重大 AI 模型更新后也要测。
我的网站从来没被任何 AI 引擎引用过怎么办?
先检查内容有没有被索引、可不可抓取(传统 SEO)。然后优化内容结构——BLUF 格式、结构化数据、适合引用的表述。跑一遍免费 SEO 审计,找出阻碍 AI 爬虫的技术问题。
我需要付费买 AI 可见性追踪工具吗?
不需要。手动测试比付费工具更准确,因为你是用当前模型测自己的真实 query。如果你管着很多网站、或者需要自动化报告,付费工具才有用;但对独立开发者来说,每月 30 分钟手动测试就够了。
出现在 Google AI Overviews 里会不会影响我的常规搜索流量?
没有明确证据表明 AI Overview 引用会蚕食常规点击。有些研究表明,被 AI Overview 引用的网站总点击量(传统 + AI)反而更多。专心争取被引用——流量账算下来是划算的。
先从关键词研究工作流开始,找出你的受众会问 AI 引擎的 query。然后用 GEO 优化策略让你的内容值得被引用。最后,每月审计你的可见性,追踪进展,及早发现差距。