← 返回专栏
· 3 分钟阅读

AI搜索可见度审计:GEO测试实用指南

你做了GEO优化,但真的有效吗?本文教你测试ChatGPT、Perplexity和Google AI Overviews是否真的引用你的内容,以及没被引用时该怎么调整。

你发布了 llms.txt。把确定性答案放在最前面。也加了结构化数据。现在的问题是:这些到底有没有用?

传统 SEO 有 Google Search Console——输入 URL,就能看到展示量、点击、排名。GEO 可没这么简单。没有任何后台能告诉你”这周你的网站被 ChatGPT 引用了 12 次”。你只能手动测试。

这篇指南讲的是怎么用一种实用、可重复的流程来审计你的 AI 搜索可见性。不用付费工具,全靠实测。

为什么手动测试比工具靠谱

2025-2026 年冒出来不少”AI 可见性追踪”工具。大多数就是拿一组固定 query 去跑某个 AI 引擎,然后卖给你一个分数。问题在于:

  • 它们测的是少量样本 query,不是你的真实 query
  • 它们拿不到个性化 AI 结果
  • 它们跟不上模型更新(针对 GPT-4 校准的工具,到 GPT-5 可能就废了)
  • 一个月 50-200 美元,而这些数据你自己花 20 分钟就能收集

手动测试慢,但更准确。你用的是受众真实使用的 query,在他们真实使用的平台上,用当前最新模型测试。

五大平台测试

在这五个 AI 搜索平台上测试。每个平台的检索机制、引用格式、受众都不一样:

  1. ChatGPT(开启联网搜索)——用户量最大,用 Bing 做检索
  2. Perplexity —— 专注 AI 搜索,来源标注最透明
  3. Google AI Overviews —— 很多 query 会出现在 Google 搜索结果顶部
  4. Claude(开启联网搜索)——用户增长快,有自己的检索机制
  5. Microsoft Copilot —— 企业用户多,基于 Bing

不用每次都测五个。先从 ChatGPT 和 Perplexity 开始——它们最可能引用独立站。如果某些 query 你已经在传统搜索有排名,再加上 Google AI Overviews。

第一步:整理测试 query 列表

别拿随机 query 测。测那些跟你的网站真正相关的。

从 Google Search Console 拉数据。 导出过去 90 天展示量最高的 50 个 query。这些是 Google 已经跟你网站关联起来的 query——AI 引擎大概率也在处理同样的 query。按我们 GSC 指南里说的,按展示量排序,筛出信息型意图的 query(疑问句、“what is”、“how to”)。

加上完整问句格式的 query。 AI 搜索用户习惯打完整的问题,不是关键词碎片。把你的核心关键词改写成问句:

  • “keyword research” → “how to do keyword research without paid tools”
  • “SEO audit” → “what does a technical SEO audit check”
  • “GEO optimization” → “how do I get my website cited by AI search”

加上对比类 query。 AI 引擎很擅长处理对比问题,而且被对比文章引用能给品牌带来曝光:

  • “what’s the best free SEO tool for indie developers”
  • “Ahrefs vs free alternatives for keyword research”
  • “ZensInk vs paid SEO tools”

目标准备 20-30 个测试 query,覆盖你的核心主题。

第二步:执行测试

每个 query,就用普通用户的输入方式,原样打进 AI 搜索引擎。记录:

  • 是否被引用?(是/否)——你的网站有没有作为来源出现?
  • 引用位置 —— 第一个被引用?第二个?第五个?
  • 引用的原文 —— AI 从你的内容里摘了什么?
  • 竞争对手引用情况 —— 还有哪些网站被引用了?

ChatGPT 测试:

Type your query in ChatGPT with web search enabled.
Look for source citations (numbered references or inline links).
Record results.

Perplexity 测试:

Type your query in Perplexity.
Check the "Sources" section below the answer.
Perplexity shows all sources — easy to scan.

Google AI Overviews 测试:

Search your query on Google.
Look for the AI Overview block at the top.
Check if your site is cited (click "more" to expand sources).

小技巧: 用无痕/隐私模式测试,减少个性化偏差。每个 query 在不同天跑 2-3 次——AI 的回答每次都会不一样。

第三步:给你的可见性打分

建一个简单的评分体系:

引用率: 你的测试 query 里有多大比例引用了你的网站?比如:25 个 query 里有 6 个引用了 = 24% 引用率。

引用位置: 被引用时,你在所有来源里排第几?第一个来源最好——用户点得最多。

平台覆盖: 你在 ChatGPT 上有引用但 Perplexity 没有?或者 Google AI Overviews 有但 ChatGPT 没有?平台之间的差距能告诉你该重点发力哪里。

对标基准: 用竞争对手的品牌名跑同样的 query。如果你没被引用的 query 竞争对手被引用了,分析原因——是他们的内容结构更清晰?还是回答更直接?

第四步:分析为什么没被引用

如果没被引用,问题基本可以归为三类:

第一类:未被抓取(索引问题)

AI 引擎还没发现你的内容。这是个传统 SEO 问题——如果 Google 找不到你的页面,AI 搜索引擎同样找不到。

检查:

  • 页面在 Google Search Console 里有没有被索引?
  • URL 在不在你的 sitemap 里?
  • 页面有没有被 robots.txt 或 noindex 屏蔽?
  • 有没有内部链接指向这个页面?内部链接是包括 AI 在内所有爬虫发现内容的途径。

修复: 确保页面可被抓取、被索引,并且网站里至少 3 个其他页面链接到它。

第二类:被抓取但没被选中(内容问题)

AI 找到了你的页面,但选了竞争对手的内容。这说明你的内容存在,但不是最适合被摘录的答案。

检查:

  • 你的页面是开头就给出答案,还是把答案埋在第八段?
  • 有没有结构化数据(表格、列表、schema)?
  • 内容适不适合被引用——有清晰、明确、自洽的表述吗?
  • 内容是原创的,还是在改述竞争对手已经说过的话?

修复:BLUF 结构重写关键部分。加上数据表格。让结论有来源可查证。这些优化同样能提升传统 SEO 排名。

第三类:被使用了但没被引用(模型问题)

AI 可能用了你的内容,但没引用。这种情况更难发现,也更难修复。这是模型行为问题,不是内容问题。

检查:

  • AI 的回答里有没有包含只有你网站才有的信息(原创数据、独家研究)?
  • AI 有没有改述你的原话但没给链接?

修复: 被用了但不被引用,没有可靠的修复办法。最好的防御是发布足够独特的原创数据和分析,让任何准确回答都必须引用你。内容越独特,AI 引擎越可能引用而不是改述。

第五步:追踪 AI 推荐流量

手动测试展示的是引用率,而统计工具展示的是实际流量影响。

在 Google Analytics 4 里:

  • 进入 Reports → Acquisition → Traffic Acquisition
  • 按 source/medium 筛选,包含:chatgptperplexitycopilotyou.comclaude.ai
  • 建一个用于 AI 推荐流量的自定义细分(custom segment)

在 Umami 或 Plausible 里:

  • 按 AI 域名筛选 referrer URL
  • 追踪月度环比增长

对大多数网站来说,AI 推荐流量还很小——占总流量的个位数百分比。但增长很快。GEO 优化做得好的网站,AI 推荐流量每个季度都在翻倍。

重要: 别指望 AI 推荐流量和引用率对得上。很多用户看了 AI 的回答(里面引用了你),但不会点进来。被引用的价值在于品牌曝光和权威性,不只是点击量。

第六步:建立可重复的审计节奏

GEO 测试不是一次性的事。AI 模型频繁更新,引用行为会变,竞争对手也在不断发新内容。

每月审计(30 分钟):

  • 在 ChatGPT 和 Perplexity 上重跑你的前 10 个 query
  • 查看 AI 推荐流量趋势
  • 留意有没有新的竞争对手出现在引用里

每季度审计(2 小时):

  • 在全部 5 个平台上跑完整的 20-30 个 query 列表
  • 重新计算引用率、位置和覆盖
  • 根据最新的 GSC 数据更新测试 query 列表
  • 和上一季度的得分做对比

重大模型更新之后:

  • 每次 GPT/Claude/Gemini 大版本更新后的 48 小时内测试
  • 模型一变,引用模式可能会剧烈变化

什么样的结果算好

基于对多个网站的测试,以下是一个 GEO 优化做得不错的网站能达到的现实基准:

指标入门中级高级
引用率(你的 query)0-10%15-30%35%+
平均引用位置未被引用第 3-5 个来源第 1-2 个来源
有引用的平台数0-12-34-5
AI 推荐流量/月0-10 次访问50-200 次访问500+ 次访问
引用稳定性随机逐步提升跨模型更新稳定

这些数字还是早期基准。随着 AI 搜索的发展,预期也会水涨船高。

常见坑

测试 query 太少。 只测 5 个 query 说明不了任何问题——AI 的回答本身噪音就很大。至少测 20 个 query,多跑几次,再下结论。

忽视 Google AI Overviews。 很多开发者盯着 ChatGPT 和 Perplexity,却忽略了 Google AI Overviews。Google 的 AI 回答出现在传统搜索结果上方,触达的受众最多。如果你的某个 query 排在 Google 前 10,你就有机会被 AI Overview 引用。

把提及当成引用。 如果 ChatGPT 在回答里提到了你的品牌名,但没有链接到你的网站,那只是品牌曝光——不是 GEO 成功。两者都追踪,但优先争取带链接的实际引用。

放弃太早。 GEO 比 SEO 更年轻,噪音也更大。第一个月零引用的网站,到第三个月可能就有 15% 的引用率——随着内容被索引、模型不断学习。坚持比早期结果更重要。

常见问题

我应该多久测一次 AI 搜索可见性?

每月做一次快速检查(前 10 个 query,ChatGPT + Perplexity),每季度做一次完整审计(全部 query,全部平台)。重大 AI 模型更新后也要测。

我的网站从来没被任何 AI 引擎引用过怎么办?

先检查内容有没有被索引、可不可抓取(传统 SEO)。然后优化内容结构——BLUF 格式、结构化数据、适合引用的表述。跑一遍免费 SEO 审计,找出阻碍 AI 爬虫的技术问题。

我需要付费买 AI 可见性追踪工具吗?

不需要。手动测试比付费工具更准确,因为你是用当前模型测自己的真实 query。如果你管着很多网站、或者需要自动化报告,付费工具才有用;但对独立开发者来说,每月 30 分钟手动测试就够了。

出现在 Google AI Overviews 里会不会影响我的常规搜索流量?

没有明确证据表明 AI Overview 引用会蚕食常规点击。有些研究表明,被 AI Overview 引用的网站总点击量(传统 + AI)反而更多。专心争取被引用——流量账算下来是划算的。


先从关键词研究工作流开始,找出你的受众会问 AI 引擎的 query。然后用 GEO 优化策略让你的内容值得被引用。最后,每月审计你的可见性,追踪进展,及早发现差距。

想给自己的站点做同样的分析?

ZensInk Pro 把这个流程自动化了。一条命令,从种子词到内容计划。

查看 Pro →