简短回答:挑 20 个你的买家真会问的问题,每周同一天、用一字不差的问法,在 ChatGPT、Perplexity、Google(AI 模式和 AI 概览)、Gemini、Copilot 里各问一遍。尽量不登录,记下日期和所在地,再记三件事:有没有提到你、有没有引用你的网页、引用的是哪一页。看几周下来的比例,别看某一次。

先定 20 个问题,定了就别改

这 20 个问题就是你的考卷。考卷每周都换,分数就没法比。

问题从买家那里来,不是从你想卖什么来:

  • 客服邮件、在线聊天、商品页问答里,买家原话问过的。
  • Google Search Console 效果报告里,已经给你带来展示的长句搜索词。
  • Reddit、论坛、测评视频评论区里,买家在问同类产品的帖子。

用英文,照买家在 ChatGPT 里打字的样子写。几类问题混着放:问推荐的、问比较的、问价格的、只描述自己处境不提品类的。下面是三个示例(示意,不是真实记录):

  • 示例:best portable power station for van life under $500
  • 示例:quietest cat water fountain for a small apartment
  • 示例:is a LiFePO4 battery worth it for weekend camping

带你品牌名的问题(比如「yourstore vs rival」)单独放一组,不算进主比例。问题里出现了你的名字,AI 几乎每次都会提到你,算进去只会让数字好看。geo-score 也是这样处理的。

每家都问一遍,条件每周都一样

AI 的回答会受账号、聊天记忆、所在地影响。条件不固定,你量到的就是这些因素的变化,不是你的店的变化。

  1. 尽量不登录。OpenAI 的帮助页写明,不登录也能用 ChatGPT 的联网搜索;登录后如果开了记忆,ChatGPT 改写搜索词时可能会用上你存过的信息。必须登录才能用的,就用一个没聊过天的账号,关掉记忆。
  2. 同一台设备,开无痕窗口,每个问题开一个新对话。把问题原样粘进去,不追问、不改字。
  3. 记日期和所在地。ChatGPT 会按 IP 推算你大概在哪,VPN 也会影响这个判断。你在深圳挂美国节点看到的,和美国买家看到的可能不一样。用哪个国家的节点,每周固定,并记下来。
  4. 每周同一天测。

Google 只能手动查。在普通浏览器里自己打开 Google,看 AI 模式的回答,再看普通搜索结果顶上有没有 AI 概览、概览里有没有你。不要写脚本或用自动化工具批量抓 Google 的搜索结果:Google 的垃圾内容政策把「向 Google 发送自动查询,包括为了查排名抓取结果」列为违规。AI 概览不是每个问题都会出现,没出现也记一笔。

每个回答记三件事,用这张表

「提到」和「引用」是两回事。提到,是回答正文里出现了你的品牌名或网址;引用,是来源列表或角标里有你网站的链接。AI 可能说了你的名字却没给链接,也可能把你列为来源、正文却没提你。两样分开记。

日期所在地引擎问题提到你引用你引用的哪一页还引用了谁备注
10-12美国节点ChatGPTQ03是否无reddit.com、一家测评站报的是旧价格
10-12美国节点Google AI 概览Q03否否无没出现概览手动查
10-12美国节点PerplexityQ07是是/pages/van-life-power一个车居论坛帖

表里三行是示意,不是真实记录。

「还引用了谁」那一栏别省。几周下来,你会看到 AI 在你这个品类里反复引用哪些测评站、论坛和视频,那是它信得过的地方,也是你下一步该去看的地方。怎么在那里露面才不算刷,见Reddit 和 YouTube 这篇。

20 个问题问 5 家,一周 100 个回答。用电子表格记,每周加一页,几周后算比例:100 个回答里有几个提到你、有几个引用你、引用最多的是哪一页。

为什么一张截图说明不了什么

同一个问题,隔几分钟再问,AI 引用的来源就可能大不一样。这是 AI 回答本身的随机性,不是你的站出了问题。geo-score 的说明里专门写了这一点:同一个问题再问一次,拿到的往往是一组很不一样的来源。OpenAI 自己也写着,搜索结果和引用可能不完整、过时,甚至是错的。

所以:

  • 老板在自己手机上问了一次,没看到店名,这只是抽了一次签。
  • 有人拿一张「AI 推荐了你」的截图当成果,也只是抽了一次签。
  • 这周比上周多了一两个提到,不算变化。看几周的走向,看比例。

记录表的意义就在这里:它把「我感觉」换成「过去几周 100 个回答里,有几个提到我们」。

想省事:用 geo-score 的 --ask 和 watch,用你自己的 API key

geo-score 是我们开源的工具(MIT 协议,见 README),分三级:第一级给网站打分,不要任何 key;第二级 --ask 当场问一个问题,看各家引不引用你;第三级 watch 每周把一组固定问题全问一遍、存档、和上次比。后两级用你自己的 OpenAI、Perplexity、Gemini、Anthropic 或 OpenRouter 的 API key,钱直接付给这些厂商,每次运行都会记下请求数、token 和花费。key 只从环境变量读,geo-score 不会把它写到任何地方。

$ git clone --branch v1.8.0 --depth 1 https://github.com/jianruntech/geo-score && cd geo-score/cli
$ export OPENAI_API_KEY=… PERPLEXITY_API_KEY=…
$ python3 geo_score.py yourstore.com --ask 'best portable power station for van life under $500'
$ python3 geo_score.py watch init --brand YourStore --domain yourstore.com --competitor "Rival=rival.com"
# 把 20 个问题写进 queries.csv,然后:
$ python3 geo_score.py watch run --dry-run
$ python3 geo_score.py watch run
$ python3 geo_score.py watch diff

--dry-run 不调用接口、不花钱,先告诉你这次要问多少次、上限是多少。watch diff 拿这次和上次比,只有变化大到超出正常波动,才会说「变了」。没配 key 的引擎记为「没测」,不算 0 分。

为什么 API 的答案和 App 里看到的不一样?API 是各家开了联网搜索的接口,App 用的模型、提示词和个性化设置都不同。所以 API 跑出来的结果只和 API 比,别和你手动在 App 里问的混在一起算。还有一点:Google 的 AI 概览和 AI 模式,通过这些接口根本测不到。Google 那一栏,还是要按上一节的办法手动查。

后台数据怎么看:AI 带来的访客常被算成「直接访问」

每周的问题表是主账本。后台的数字可以对照着看,但别指望它把来源拆得干干净净。

  • Google Analytics 4:默认渠道里有一个「AI Assistant」,按来源网址认,从 ChatGPT、Gemini、DeepSeek、Copilot、Grok 这类地方点进来的访问归到这里;Google 的 AI 概览和 AI 模式不算在里面。
  • 直接访问:GA4 把「用收藏的链接或手动输入网址进来」算作直接访问。买家在 AI 的回答里看到你的店名,再自己敲网址进来,后台就只能记成直接访问。点进来时没带来源信息的,也落在这里。
  • utm_source=chatgpt.com:OpenAI 写明,从 ChatGPT 搜索结果点出去的链接会自动带上 utm_source=chatgpt.com。在 GA4 里按会话来源筛 chatgpt.com 就能看到这一部分。它只覆盖点链接进来的人。
  • Shopify:开了 Agentic Storefronts 的店,从 AI 渠道来的订单,后台会显示渠道或来源归因。
  • Search Console:新的「生成式 AI 效果报告」,2026 年 8 月 31 日起所有网站都能看,显示你的链接在 AI 概览和 AI 模式里被展示了多少次,可以按页面、国家、设备分。它说的是展示次数,不是点击。展示太少时,报告不会出现。
  • Bing Webmaster Tools:AI Performance 报告显示你在 Copilot 和 Bing AI 摘要里被引用了多少次、被引用的是哪几页,以及 AI 检索时用了哪些词。
  • 成交时问一句:后台追不到的那部分,最省钱的办法是直接问买家。在下单后的感谢页或确认邮件里放一道单选题「你是从哪里知道我们的?」,选项里写上「ChatGPT 等 AI 助手」;做询盘的外贸站,把这道题放进询盘表单(设成选填)或第一次回复里。答案会漏、会记错,只看比例怎么变,不当精确数字。

示例:有卖家在 r/shopify 发帖说,客户告诉他是从 ChatGPT 知道这家店的,Shopify 后台却显示直接访问。这很常见。每周问题表告诉你 AI 有没有提到你,成交时问的那一句告诉你有多少单是这么来的,两样要一起看。

常见问题

一定要每周测吗?隔两周行不行?

行。要紧的是固定:同一组问题、同一天、同样的条件。隔两周测,只是看出走向要多等一阵。别今天想起来测一次、下个月再测一次,那样几次之间没法比。

20 个问题够不够?

够起步。问题太少,两次之间的差别分不出是真变化还是正常波动。用 geo-score 的 watch run --dry-run 能先看到这组问题能测出多大的变化;两次运行共同的问题少于 6 个时,watch diff 会直接告诉你「太少,看不出」(geo-score 说明)。

AI 提到了我,但价格说错了,怎么办?

先记在表的备注里,再看它引用的是哪一页。r/shopify 上有个真实例子:一家开了一年半的水晶饰品店,顾客拿着 ChatGPT 给的 24 美元来要求比价,店里现价是 34 美元(原帖);店主自己去问,发现 ChatGPT 引用的是一篇别人很早以前写的博客,里面还是开业促销价。OpenAI 也写过,搜索结果和引用可能过时。你能做的:把自己站上的价格、参数写清楚并保持更新,自己站上的旧页面该改的改;第三方页面上的旧信息,礼貌地联系作者请他更新。

你们的监测版和自己测有什么不一样?

做的是同一件事,换我们来跑:每周用 4 家 AI 的接口问同一组 20 个问题,记下有没有提到你,每月出一页报告,¥2,888 / 季度,不改你的站。它只走接口,所以测不到 Google 的 AI 概览和 AI 模式,这一栏仍要有人手动查。详见价格页。

想知道你的站卡在哪? 用 geo-score 自己测,或者留下官网,48 小时内收到免费速览。

来源

  1. Searching the web with ChatGPT(OpenAI 帮助中心),核对于 2026-10-08
  2. Publishers and Developers - FAQ(OpenAI 帮助中心),核对于 2026-10-08
  3. Spam policies for Google web search(Google 搜索中心,页面标注 2026-08-28 更新),核对于 2026-10-08
  4. Generative AI performance report (Search)(Search Console 帮助),核对于 2026-10-08
  5. Default channel group(Google Analytics 帮助),核对于 2026-10-08
  6. Shopify agentic storefronts(Shopify 帮助中心),核对于 2026-10-08
  7. Introducing AI Performance in Bing Webmaster Tools Public Preview(Bing 站长博客,2026-02-10),核对于 2026-10-08
  8. geo-score README:Three levels, one tool;Levels 2 and 3;Scope,核对于 2026-10-08
  9. geo-score cli/README:watch 命令与 queries.csv,核对于 2026-10-08
  10. r/shopify:Customer said they found us through ChatGPT but Shopify shows direct traffic,经 Arctic Shift 公开存档读取,核对于 2026-10-08
  11. r/shopify:Anyone know why ChatGPT would quote us a price we have not charged since we first opened, over a year ago,经 Arctic Shift 公开存档读取,核对于 2026-10-08