GEO 第三阶段复盘:四周提及率涨了 10 个点,但先把口径说清楚

GEO 第三阶段复盘:四周提及率涨了 10 个点,但先把口径说清楚

上一篇《GEO 两个阶段复盘:上海站住了,广东没有》写到 8 月 9 日。

当时我刚把原来比较笼统的「全国」问题拆成 10 个城市,行业词提及率也因此从 15.8% 掉到了个位数。那时候我的判断是:不是 GEO 效果突然变差,而是监测的范围变大了。

现在又过去了将近一个月。

从 8 月 10 日到 9 月 3 日,我一共拿到了 3573 次行业词采样。监测对象还是财精灵,覆盖豆包、DeepSeek、Kimi、千问、元宝五个平台。每天把固定问题跑一遍,记录 AI 有没有提到财精灵、排在第几、是不是首位,以及回答里的引用情况。

这一个月最直观的变化是:

  • 行业词提及率从谷底 6.6% 涨到 18.6%
  • 如果只看一直没有变过的那批问题,则是 6.2% → 16.7%
  • 首位率从 2.6% → 7.3%
  • DeepSeek 从完全不提财精灵,到开始出现稳定提及
  • 10 个城市的提及率全部上涨
  • 同一批行业问题里,财精灵从竞品榜第 3 来到了第 1
  • 但也出现了一个反向信号:8 月 10 日以后,千问没有再引用过一次 caigeek.com

整体是在涨。

不过在真正分析这些数据之前,我得先把一个问题说清楚:这一个月的数据并不是完全同口径的。

灵瞳 GEO 总览页
灵瞳总览页,近 30 天口径:提及率 13.2%、首位率 6.8%、平均排名分 10.3、SOV 2.5%。下方「内容被引用」是 4670 次精确命中,501 篇内容里有 135 篇被 AI 引用过。这一屏的窗口是近 30 天(约 8 月 6 日起),还带上了 9 月 4 日当天没跑完的采集,所以 13.2% 比正文按 08-10 ~ 09-03 算出来的 14.4% 略低。

一、这一个月,我其实改过两次监测问题

我一开始差点忽略了这件事。

写这篇文章的时候,我原本想直接拿 8 月初和现在的数据做对比。后来重新检查采集流水才发现,8 月 15 日和 8 月 25 日,我分别调整过一次监测题集。

生效日期版本变化调整内容
08-15v7 → v9义乌新增 1 个问题:「义乌电商财务外包公司推荐」
08-25v9 → v12激活「核心品类与服务商推荐」下的 6 个问题,并新增 1 个品牌词问题

第二次调整影响比较大。

因为新加入的 6 个问题,本身就是:

国内专业的电商财务外包服务商有哪些?
电商企业应该怎么选择财务外包公司?

这种和我过去几个月持续生产的内容高度相关的问题。

而恰好从 8 月 24 日这一周开始,提及率出现了一次比较明显的上涨。

所以如果直接看面板,很容易得出一个结论:

「这一周 GEO 效果突然变好了。」

但实际上,其中一部分上涨来自内容效果,一部分来自新增问题。

为了把这两件事分开,下面涉及趋势的数据,我都会同时看两套口径:

面板口径:包含后来新增的问题。

恒定题集:只统计从 8 月 10 日开始就一直存在、期间没有调整过的问题。

这样至少可以判断,到底有多少增长是真正来自 GEO 本身。

灵瞳品牌数据页的口径变更提示
灵瞳品牌数据页其实一直在提示这件事:中间那条黄色横幅写着「窗口内调整过监控话题口径(08-04 v1→v4、08-05 v4→v7、08-15 v7→v9、08-25 v9→v12),变更点前后数据不直接可比」,三张趋势图上的橙色竖虚线就是这四个变更点。前两次在上一篇里交代过,后两次是这个窗口内新增的。这一屏选的是「全部数据」而不是近 30 天,所以提及率显示 12.4%。

二、把新增问题剔掉以后,趋势依然成立

先看最核心的一组数据。

周次起始日期面板样本面板提及率面板首位率恒定题集样本恒定题集提及率恒定题集首位率
W3107-274809.8%4.8%3607.8%4.2%
W3208-0310466.6%3.1%9846.2%2.6%
W3308-10101211.6%5.8%97712.0%6.0%
W3408-1782612.1%6.7%79912.1%6.6%
W3508-24106816.2%9.0%85814.1%7.0%
W3608-31(4 天)66718.6%8.7%53416.7%7.3%

W32 是整个阶段的谷底。

那一周正好是把 GEO 从「全国」拆到具体城市后的第一个完整周。

从这里往后看,行业词提及率连续四周上升。

如果直接看面板,是:

6.6% → 18.6%

涨了 12 个百分点。

如果只看恒定题集,则是:

6.2% → 16.7%

涨了 10.5 个百分点。

两条曲线的方向基本一致。

也就是说,8 月 25 日新增的问题确实放大了一部分涨幅,但即使把它们全部剔除,剩下的增长依然很明显。

首位率也是一样。

恒定题集从 2.6% 涨到了 7.3%

所以至少有一件事现在可以确定:

最近一个月 GEO 的提升不是单纯靠调整监测问题「调出来」的,原有问题本身的表现也在持续变好。

需要注意的是,W36 只有 8 月 31 日到 9 月 3 日四天,还不是一个完整周,所以暂时不适合拿它单独做结论。

另外,品牌词一直维持在 95% 以上,本期是 96.5%。

这也是我后来一直坚持把「品牌词」和「行业词」拆开看的原因。

品牌词回答的是:

别人已经知道你以后,AI 能不能认出你。

行业词回答的是:

别人还不知道你时,AI 会不会主动推荐你。

对 GEO 来说,后者明显更重要。


三、10 个城市全部上涨,但差距还是很大

这次地域数据有一个比较好的信号:

没有一个城市下降。

下面的数据统一使用恒定题集。义乌因为 8 月 15 日单独新增过一个问题,所以我把两种口径都列出来。

城市08-04~08-0908-10~09-03本期样本本期首位次数
上海39.1%48.7%22453
深圳10.4%20.2%34237
北京3.2%17.8%34344
广州3.1%12.4%33826
杭州3.1%10.5%34417
佛山0.0%8.9%3368
东莞1.0%8.2%33110
宁波3.1%7.9%3437
成都0.0%4.1%3417
义乌(原有 2 题)1.6%4.0%2262
义乌(包含新增题)2.1%8.9%33815

上一篇的时候,佛山和成都还是 0。

现在分别到了 8.9% 和 4.1%

深圳从 10.4% → 20.2%,也基本翻了一倍。

但这一轮真正让我意外的是北京。

北京从 3.2% 涨到了 17.8%,而且北京没有受到这两次题集调整的影响,所以这个上涨相对比较容易解释为原有题集本身的变化。

更有意思的是,我上一篇原本计划重点做深圳,把深圳当作「上海打法能不能复制」的测试城市。

实际执行的时候,我并没有真的只集中做深圳,内容还是分散到了各个城市。

最后反而是北京涨得更快。

为什么?

现在还没有答案。

可能和内容主题有关,也可能和不同平台的搜索结果、引用来源有关。下一步我会单独拆北京,看它最近到底在引用哪些页面。

话题 × AI 引擎排名分热力矩阵
话题 × AI 引擎排名分热力矩阵,近 30 天。绿色是 70-100,黄色 40-69,红色 0-39,灰色是未提及。上海在豆包上 76 分是全表唯一的绿格;DeepSeek 那一列除了上海 4 分、北京 2 分之外基本还是红的;佛山和成都仍有整片未提及。

不过虽然所有城市都在涨,地域之间的差距依然非常明显。

上海已经到了 48.7%,深圳 20.2%,北京 17.8%,后面的城市大部分仍然只有个位数到十几个点。

所以现在的状态已经不像上一篇那样是明显的「断崖」,但依然存在清楚的梯队。


四、DeepSeek 终于开始提财精灵了

上一篇最难看的数据其实不是城市,而是 DeepSeek。

当时累计跑了 410 次行业词采样,一次都没有提到财精灵。

这一个月终于破零了。

全库第一次出现 DeepSeek 行业词提及,是 8 月 15 日

而且这一次命中的还是原有问题,不是当天新增的义乌问题。

但如果继续往下拆,会发现 DeepSeek 目前的覆盖还很薄。

口径采样提及次数提及率出现提及的日期
面板口径724304.1%共 13 天
恒定题集641132.0%共 6 天

面板上看是 30 次,但剔除 8 月 25 日新增的问题以后,只剩 13 次

而且真正开始连续出现提及,是从 8 月 30 日之后。

所以现在更准确的描述应该是:

DeepSeek 已经从完全不认识,进入了偶尔会提、最近开始出现连续提及的阶段。

这和「已经做起来了」还是两回事。

但从 0 到 1 本身依然值得记录。


五、不同 AI 平台的表现,开始明显分化

把五个平台拆开看以后,差距比一个月前更明显了。

平台08-04~08-0908-10~09-03 面板口径08-10~09-03 恒定题集本期首位率
Kimi14.5%39.1%40.7%17.8%
豆包5.2%13.0%10.3%8.8%
元宝5.2%10.7%10.2%5.2%
千问3.5%6.8%5.5%4.3%
DeepSeek0.0%4.1%2.0%2.1%

最明显的是 Kimi。

14.5% 涨到了 39.1%

如果只看恒定题集,甚至到了 40.7%

这意味着 Kimi 的增长并不是新加问题带起来的,相反,新问题还稍微拉低了它的平均值。

从目前的数据来看,内容生产对 Kimi 的反馈最明显。

各平台 AI 表现对比
各平台 AI 表现,近 30 天口径。Kimi 提及率 36%、首位率 16%,五角形明显比其它四家饱满;DeepSeek 4% / 2%,千问 6% / 4%。这一屏比正文表格多带了 8 月上旬那几天的低值和 9 月 4 日的半天数据,所以 Kimi 显示 36%,而正文按 08-10 ~ 09-03 算出来是 39.1%。

豆包和元宝也在稳步上涨,但幅度没有 Kimi 那么夸张。

DeepSeek 则依然是五个平台里最难做的。

真正让我比较在意的,是千问。

它的提及率从 3.5% 涨到了 6.8%,表面上还是正向的。

但引用数据出现了完全相反的变化。

周次千问引用条数指向 caigeek.com
W304150
W311771427
W322548151
W3322550
W3418720
W3514860
W3610760

从 8 月 10 日开始,千问一共记录到了 6689 条引用

其中指向 caigeek.com 的:

0 条。

而同期 Kimi 的 12664 条引用里有 2249 条来自 caigeek.com,豆包 17086 条里有 680 条,元宝 12183 条里有 183 条。

千问从之前会引用,到突然完全不引用,这个变化很明显。

目前我还不知道原因。

有可能是千问调整了搜索或内容源,也有可能只是它的页面结构发生变化,导致我现在的引用解析逻辑没有正确识别。

这件事我暂时不准备猜。

先把问题记录下来,后面单独排查。


六、同一批行业词里,财精灵从第 3 到了第 1

上一篇统计的时候:

  • 快商科技:131 次
  • 慧算账:107 次
  • 财精灵:69 次

财精灵排第 3。

这次统计 8 月 10 日到 9 月 3 日的行业词:

品牌面板提及面板首位恒定题集提及恒定题集首位
财精灵514268424211
慧算账3801332812
快商科技3619335092
大账房1333963
八米财税1121110211
华财会计1127927

无论按照面板口径还是恒定题集,财精灵都是第 1。

竞品分析排名榜
竞品分析页排名榜,近 30 天、全部话题口径:财精灵 575 次提及、13% 提及率、7% 首位率排第 1,快商科技 470 次第 2,慧算账 467 次第 3。正文表格用的是 08-10 ~ 09-03、纯行业词口径,所以绝对数字对不上——面板这一屏还包含品牌词和 9 月 4 日当天的数据。名次顺序在两种口径下一致。

而且比「提及次数」变化更明显的,其实是首位次数。

比如慧算账虽然出现了 380 次,但只有 13 次排在第一位。

财精灵则是:

514 次提及,268 次首位。

换成恒定题集依然有:

424 次提及,211 次首位。

也就是说,现在的变化已经不只是「AI 偶尔会把财精灵列进去」,而是越来越多的问题里,财精灵开始被放在前面推荐。

不过这个排名必须加一个边界。

我监测的本来就是围绕「电商财务外包」选出来的一批行业问题。

所以这个结果能说明的是:

在我监控的这批电商财务外包相关问题里,财精灵目前排在前面。

不能直接扩大成「财精灵已经是整个财税行业 AI 推荐第一」。

这两个概念差得很远。

同一个窗口里,AI 总共提到过 4554 个其它品牌,累计出现 18616 次。财精灵的 514 次放进整个品牌池里,占比大约只有 2.5%。

所以目前更多还是一个垂直细分赛道里的结果。


七、另一个变化:网站开始被越来越频繁地抓取

除了 AI 回答里的品牌提及,我还一直在看 caigeek.com 的 nginx 日志。

通过 User-Agent,可以看到各种搜索引擎和 AI 爬虫访问网站的情况。

这部分数据和我怎么调整监测问题没有关系,所以反而更适合作为另一条独立趋势来看。

周次全部爬虫请求抓取独立页面
W26(06-22)520256
W28(07-06)883211
W30(07-20)1473243
W31(07-27)2445971
W32(08-03)65402936
W33(08-10)113616141
W34(08-17)68592407
W35(08-24)93332812
W36(08-31,4 天)77872604

6 月的时候,每周只有几百次爬虫请求。

到了 8 月,基本已经稳定在 6000~11000 次/周

被抓取的独立页面也从最开始每周两百多个,增加到了现在的两三千个。

目前累计比较明显的 AI 类 User-Agent 包括:

  • meta-externalagent:3716
  • OAI-SearchBot:2931
  • ClaudeBot:1161
  • ChatGPT-User:1042

传统搜索引擎更多:

  • GoogleOther:10213
  • Bytespider:8915
  • Googlebot:3973

这至少说明一件事:

随着内容量增加,网站确实正在被越来越多机器访问和读取。

但这里我不想强行把它和前面的 GEO 提及率画等号。

因为日志里能识别出来的 AI 爬虫,大部分对应的是境外模型;而我现在主要监测的是豆包、DeepSeek、Kimi、千问和元宝。

国产模型获取网页内容时,可能走搜索引擎,也可能走自己的索引,未必会直接回源到 caigeek.com,更不一定会留下容易识别的 User-Agent。

所以现在只能确认:

内容被机器抓取的规模在增加。

至于「哪一次抓取最终变成了哪一次 AI 推荐」,目前还没有打通。


八、阶段性总结:这段时间到底提升了多少

把上一篇的节点和现在放在一起对比。除了爬虫那一行,其余全部用恒定题集,也就是同一批问题在不同时间的表现。

指标8 月 9 日(上一篇)9 月 3 日(现在)变化
行业词提及率6.2%16.7%+10.5 个点
行业词首位率2.6%7.3%+4.7 个点
平均排名分4.612.9+8.3
上海39.1%48.7%+9.6 个点
深圳10.4%20.2%接近翻倍
北京3.2%17.8%+14.6 个点
佛山0.0%8.9%破零
成都0.0%4.1%破零
Kimi14.5%40.7%+26.2 个点
DeepSeek0.0%2.0%破零
竞品位次第 3(69 次提及)第 1(424 次提及)
每周爬虫请求65407787~11361

如果只用一句话概括这一个月:

行业词提及率涨了 10 个点,首位率接近翻了三倍,覆盖面从「个别城市有量」变成「十个城市全部有量」,平台从「四家有量」变成「五家全部有量」。

这里面有三件事我认为是确定的。

第一,增长不是靠改口径改出来的。 剔除窗口内新增的全部 7 个问题以后,提及率依然从 6.2% 涨到 16.7%。新增问题大概贡献了 1.5 到 2 个百分点,剩下的来自内容本身。

第二,覆盖面的扩大比数字本身更重要。 一个月前,佛山、成都是干净的 0,DeepSeek 整列都是「未提及」。现在这三个格子都有数了。从 0 到 1 和从 4% 到 8%,是两种不同性质的进展,前者说明「能被看见」这件事成立了。

第三,位次的变化比提及量的变化更实。 财精灵 424 次提及里有 211 次是首位,接近一半;慧算账 328 次提及只有 12 次首位。这说明 AI 现在不只是「顺带提一句」,而是在相当一部分问题里把财精灵放在了推荐的第一位。

但同样有三件事还没有结论。

一是千问的引用为什么归零。 这是这一个月唯一一个反向指标,而且转折很突兀,暂时分不清是它换了检索源,还是我的解析失效了。

二是北京为什么涨得比深圳快。 我原本以为深圳会是最先起来的那个,结果是北京。这说明我对「内容投入 → 城市表现」之间的因果理解还不完整。

三是抓取量和提及率之间还没有打通。 日志侧看到的是境外爬虫,监测侧看的是国产模型,这两块数据现在是断的,只能各自成立,不能互相印证。

最后想说明一下量级。

16.7% 听起来还行,但换算过来是:大约每六次提问,AI 只会在其中一次提到财精灵。

这个数字放在传统 SEO 里是很难看的。

但同一批问题下,排在后面的竞品也就是 350 次上下的量级,整体水位就是这么低。

所以我现在的判断是:GEO 目前仍然处在一个「谁先做谁先占位」的早期阶段。绝对值不高不代表没有价值,但也确实还远远谈不上稳定。


下一步

  • 排查千问自有域名引用归零的原因
  • 单独拆北京的引用来源,搞清楚它为什么比深圳涨得快
  • 接下来一个月不再调整监测问题,攒一段真正同口径的对照数据
  • 备用池里还有 23 个地域没有激活,采集配额目前仍然是瓶颈
  • 把日志侧的抓取数据和引用来源做关联,现在这两块还是断的

上一篇结尾我写的是:GEO 是一个个城市、一个个平台、一个个提问分别打下来的。

这一个月没有推翻这句话。

只是补了半句:也得把自己每一次改动记清楚,涨的那部分才算得清。