智能体时代的营销 · Canlah AI · 新加坡 SEO + GEO 机构
2026 年 7 月 15 日,一篇覆盖 45 项 GEO 研究的批判性综述给出结论:在其审阅范围内,没有任何一项技术展示出稳定的、纵向的、跨平台的、对有机可发现性或下游行为的因果效应(arXiv:2607.14035,A−,单作者预印本)。
我们把这句话放在本章开头,而不是藏在脚注里,原因有三:
其一,任何具备判断力的采购方都会在一次搜索之内找到它。先被对方拿出来,和自己先拿出来回答,是两种完全不同的处境。
其二,它基本上是对的。下文将说明我们在哪一点上认为它需要限定 —— 但那是一个范围限定,不是一个反驳。
其三,这篇综述的存在本身,就是本报告第四章测量规范的正当性来源。 如果因果效应至今未被稳定证明,那么继续售卖”排名提升”的产品就是不诚实的。
那么在因果尚未被证明的前提下,还剩下什么是可以负责任地交付的? 三件事,而且都可验证:
诚实的产品定义因此是:我们卖诊断、修错与受控实验,不卖排名承诺。 这个范围比行业通行的说法小,但它里面的每一项都能在交付时被你验证。
被广泛引用的”GEO 可提升可见度 40%“,出自普林斯顿等机构 2023 年的工作、发表于 KDD ’24(arXiv:2311.09735,A,本报告引用的唯一同行评审文献)。这个数字需要三重限定:
该研究中最具销售价值的一条是所谓”均衡效应”:原本排名第 5 的站点,通过”引用来源”这一项优化,AI 可见度提升 +115.1%。
这条被广泛引用,但几乎从不与它的另一半同时出现:在同一实验条件下(全部来源均优化),原本排名第 1 的站点下降 30.3%。
本报告规定:+115.1% 永不单独出现。 只讲前一半,是把一个零和再分配描述成了增量创造。诚实的表述是:GEO 在候选集内部重新分配引用份额,它系统性地有利于中后位者、不利于领先者 —— 这对挑战者品牌确实是好消息,但机制是再分配,不是增长。
该论文第 6 节表 5 显示:关键词堆砌在 Perplexity 上的表现比基线低约 10%(PAWC 21.9 对基线 24.1,即 −9.1%)。
撰写本报告过程中,一轮自动化研究曾提出”原论文并无负值,应改为’几乎无提升’“。该修正经复核被驳回 —— 原始表格确实给出负值,提出的”修正”本身是错误的。我们保留这一记录,是因为它例证了本报告卷首的判断:在这个品类里,错误传播的方向是双向的,包括朝着”更保守”的方向传播错误。 逐条回到一手来源是唯一可靠的做法。
把第 3.1 至 3.4 节的限定叠加起来,剩下的可辩护结论比通常的 GEO 清单短得多,而且重心完全不同:
发现环节与引用环节必须分开处理。 一项针对 ChatGPT 的研究给出了迄今最刺眼的一组对照(A−,预印本):当查询中点名品牌时,模型对其召回率为 99.4%;而在不点名的品类查询中,该品牌被主动发现的比例仅为 3.32%。同一研究中,站内 GEO 评分与被发现率不相关;在 Perplexity 上呈现正相关的是引荐域名数(r = +0.319)与 Reddit 存在度(r = +0.395)。
另一项包含约 25.2 万次试验的研究显示:仅做格式层面的改写,效果基本为零。
三条结论:
本章的诚实结论:GEO 能可靠改变的,是已被检索到的内容是否被引用,以及在候选集中的相对份额。我们尚未能证明它可以稳定改变内容是否被检索到、或产生持久的下游流量 —— 据我们所知,也没有人证明过。因此我们把承诺限制在这个范围内,并用预注册对照来检验每一次具体投入是否奏效。