每月用冻死的尺子再问一次。结论不写「有效 / 无效」,写下个月打哪三个点;同时留下三个不依赖 AI 波动的确定性数字,证明这个月的活确实落了地。
7.1 复测的产出与量具
这一节要你做的:把月度复测的结论从「有没有效」换成「下个月打哪三个点」。做完这一节,你手上有五把各测一件事的量具、每把必须原样印出的局限,以及四句不会再说出口的话。
顺序写死:先读免费的第一方数据,再看花钱的探测。
为什么不用统计判定
按统计口径跑,第 13 周的默认输出必然是「未能证明」——你自带了一条「这事没用」的结论,无论实际有没有动(阈值怎么算出来的,证据见 → 通用版 A.2 选点、写页、站外与复测的证据)。改法不是放宽统计,是换验收物。名次是被工单推动的,不是被 p 值推动的。
自己做的人,最小可行量具 = 三个数 + 一条页级信号 + 一条对照腿。不需要 Wilson 区间、不需要对照页、不需要置换检验,但必须能诚实地分开「真动了」和「噪声」。三个数是下面的席位数、在册且被引、事实错误条数;页级信号和噪声带在 7.2;对照腿的完整规格只在 → 通用版 4.4 网页对照腿与冻结基线(全书唯一完整规格)。
先把腿的名字叫对
两条接口腿的正式名称是 ① OpenAI 接口腿、② Gemini 模型腿。三个产品三把尺的对应图在 → 通用版 1.2 两条腿:ChatGPT 找源头,AI Mode 找二手,这里只补复测时最常犯的三个错:
- 把 Gemini 模型腿的数字当成「Google AI 概览里的可见度」。Gemini API ≠ AI Overviews ≠ AI Mode,抓取通路、答案生成方式、来源池都不一样,一条腿的数冒充另一条,等于量了 A 去验收 B。AI Overviews / AI Mode 的可见度只用 GSC 生成式 AI 报告的曝光数。
- 判 AI 概览能不能抓你时去看
Google-Extended。应该看Googlebot。Google-Extended管的是训练与 Gemini 应用侧,屏蔽它不影响 AI 概览是否收录你;Googlebot被挡才是门关着。 - 把接口腿的结果说成「用户在 ChatGPT 里会看到」。只有接口腿证据的,表述一律限定为「在模型接口上」。
五把量具,各答一件事
每把量具怎么数、必须原样印在报告上的局限:
| 量具 | 怎么数 | 必须原样印出的局限 |
|---|---|---|
| 在册页数(两行报:在册 X/20 与 在册且本月被引 Y/20) | 冻结的基线 Top 20 来源里,现在有多少页上确实出现你(人工逐条打开 + 截图)。分母 20 全季不变 | 在册 ≠ 被引:AI 可能引了这一页却没念到你那一行,在册是必要条件不是充分条件。判读写死:在册涨、在册且被引不涨,连续两个月 → 你投的是不被引的容器,下月只往本月实际被引过的来源投 |
| 席位数 | 本月 N 次问答里你的名字被点到的次数;同时记本月总名额(所有商家名次数之和)与每个对手的席位数 | 你自己的题池、引擎、遍数下的抽样计数,不代表全市场;总名额会随答案长短变化,必须同时印总名额与席位占比;随遍数线性放大,遍数变了两个数不许并排、不许相减 |
| 事实错误条数 | 品牌六问(6 句 × 3 轮 × 2 引擎 = 36 次 / 月,全季冻结,定义见 → 通用版 3.5 品牌六问与发现错误之后)人读,逐处抄下 AI 说错的事实,附原文截图 | 整套量具里最硬的一格;只测事实对不对,不测名次。如果只盯一个数,盯它:错误是 AI 从被检索的源页面抄来的,源头修好两条腿都跟着变,它对接口 / 网页的通路偏斜最不敏感 |
| 同周重测噪声带 | 见 7.2 | 噪声带本身也是抽样值 |
| AI 概览 / AI Mode 曝光 | GSC 生成式 AI 报告的曝光数,按页、按国家导出(免费、第一方) | 只有曝光,没有点名与位次;已含在总曝光里,不能与总曝光相加;导出时空值变 0 要标出 |
席位就是点名次数,只有一个名字。不许把「席位实数」和「答案级点名次数」写成两行——那是同一个数,拆成两行的唯一效果是:被禁止单独报的那个噪声量换个名字,就混进了达标判据。
拆法随行业变,定义不变
量具的定义一个字不改,能改的只有拆法:
- 席位可以拆两把:一个品类同时有答案货架和购物货架时,品牌席位(答案货架)与商品卡位和首位占比(购物货架)分开数,各配一条噪声带。本答案总名额按品类实测写死,不许沿用别的品类的数。
- 分母可以按作业单位拆:两条战线的点名集合几乎不重叠时(按产品线、按学段 × 科目),分母分开报;合并成一个分母,两条独立战线的涨跌会互相抵消。
- 事实错误可以拆两栏:「自有源错」与「第三方错」分开记——两者修复路径和生效周期完全不同(7.3 第 2 层)。
- 噪声带的轮数是行业变量,首季自己量。第四个参考数(询盘来源之类)按行业选,只有这一格随行业变,且不进验收。
举例(电商)席位拆成两把:品牌席位(答案货架)+ SKU 卡位与首位占比(购物货架),噪声带也量两条,品牌席位与 SKU 卡位各一条。
网页版与接口之间的来源偏斜是系统性的、不是噪声,加轮数不解决——数字只在 → 通用版 4.4 网页对照腿与冻结基线(全书唯一完整规格) 出现一次。
四句不许说的话
写报告、跟老板或客户汇报、自己在心里总结,都不许出现左边四句。为什么:在册 ≠ 被引;席位占比是你自己题池下的抽样计数,不是市场;未超噪声带的涨是把噪声当成果;两把量具分母不同、失败模式不同,加总后任何一个变坏都能被另一个盖住。月报上必须原样印的那一句噪声带声明,见 → 通用版 B.2 口径句与话术。
复测时还有三条判据,完整说法在 → 通用版 1.4 不要做的三类事,这里只拿来用:
- 单次、单引擎、n ≤ 3 的观测只能作方向证据,不能宣布「零可见度」;
- 题池措辞能拍出假的零:裸品类词占多数时,先怀疑量具(7.3 第 4 层),证据见 → 通用版 A.2 选点、写页、站外与复测的证据;
- 在册页数涨了也照样走分诊,触发条件只看席位(7.3)。
7.2 噪声带、页级信号与每月十步
这一节要你做的:每月多出三样东西——一个实测的噪声带数值、一份页级信号命中清单、一张排好人和工时的月度日程。有了噪声带你才知道哪些涨跌能写进结论,有了页级信号你才知道哪一页真被读走了。
噪声带:最容易做错的一格
做什么:同一批问句、同引擎、同遍数,在同一周内再跑 3 次,得 X′ / X″ / X‴。多久:约 1.5 小时 / 月(机器跑,人只看落盘)。怎么验:三份独立落盘的答案包,时间戳都在同一周内;噪声带数值写进月报第一页。
图上几道关的写法都是固定句:第 1–2 个月标「噪声带基准尚未稳定(已记录 K/3 个月)」;样本不够的那个月只印各腿分列数,不印合计、不与上月比较。图画不出来的是噪声带本身怎么定:
| 规矩 | 为什么 |
|---|---|
| 跑 3 次,不是 1 次 | 用一次抽样差当另一次抽样差的阈值,在「什么都没发生」的零假设下两者同分布,误报率约 50%。跑 3 次把误报从 100% 降到 50%,不是降到 0 |
| 噪声带 = max−min 的极差,下限写死 ±1 席,三次全相同也按 ±1 记 | 极差为 0 时任何 +1 都会被判「增加了」,闸门反向失效 |
| 基准取三个月的中位数,不取最大值 | 取最大值是单调不减的棘轮——跑得越久越难宣布任何改善,最后形成「量具越差越免责」的闭环 |
| 噪声带连续两个月扩大 → 加遍数重测,不得再次援引「量具缺陷,本月不计」 | 免责条款用两次以上就成了免责机器。加遍数就是换尺子,按 7.5 另起基线 |
| 一条腿当月有效样本 < 计划量的 80% → 该月标「量具不完整」 | 一条腿整月缺失,跨引擎的绝对计数会腰斩。这和「加遍数导致席位翻倍」是同一个病的两面 |
页级信号:唯一能给出页级因果的东西
登记的必须是该页独有的可核事实字符串——例:这一页价目表里写死的 S$6,800。形容词、别的页也有的句子不算,搜到了也说明不了是哪一页被读走。
它和席位数无关、和噪声带无关,完全复用你已经在存的答案原文包,增量近零。席位数告诉你整体在不在涨,页级信号告诉你是哪一页在起作用——两个数分开记,不互相推。
每月十步:并成八段
- 1第一方数据步 1:Bing AI Performance + GSC,0.5 h
- 2复测步 2:同题池、同引擎、同遍数,2 h
- 3噪声带步 3:同周再跑 3 遍,1.5 h
- 4数席位步 4:点名、位次、总名额 + 页级信号,1.5 h
- 5在册复查步 5:X/20 + 本月被引没有,1.5 h
- 6档案六问体检步 6–8:档案一致、36 次六问、原有搜索体检,2.5 h
- 7分诊步 9:7.3 五层,1 h
- 8月报步 10:固定日期发,2 h;合计约 12.5 h
第 1–4 步只负责把「货架现在长什么样」量准;真正推动名次的是第 9 步——没有第 9 步,前八步就是记账。
插队规则:AI 出现关于你的错误陈述或负面倾向 → 插队先修,不等月报(五种插队情况见 → 通用版 3.5 品牌六问与发现错误之后)。
网页对照腿的 40 分钟不在这张表里,每月初单独排一天做掉,规格见 → 通用版 4.4 网页对照腿与冻结基线(全书唯一完整规格)。
每一步谁做、交什么、谁验:
| 步 | 谁做 | 产出 | 谁验 | 图上没写的要点 |
|---|---|---|---|---|
| 1 | 出报告的人 | first_party_<月>.json | 自查 | 导出本月承接页曝光与 Citation Share |
| 2 | 跑探测的人 | probe_<月>/ 逐条答案原文 | 自查 | 额度不够没测的引擎印「未测」 |
| 3 | 跑探测的人 | probe_<月>_retest/ + 噪声带数值 | 出报告的人 | — |
| 4 | 跑探测的人 | seats_<月>.csv + 页级信号命中清单 | 出报告的人 | 每个答案点了哪几家、第几位、本答案总名额 |
| 5 | 做站外的人 | offsite_ledger_<月>.csv | 项目负责人 | 基线 Top 20 逐条打开:你在不在、排第几、信息有没有过期;顺手给每条打五个页型二值特征 |
| 6 | 管档案的人 | 同上台账 | 项目负责人 | 评价三数是被动观测;五处档案一致性 |
| 7 | 跑探测的人 | brand-6.jsonl + entity_errors.md | 人读,不许跳 | 6 句 × 3 轮 × 2 引擎 = 36 次,出事实错误条数 |
| 8 | 改站的人 | 体检页(含四身份四份回执 + nosnippet 三处 grep 截图) | 项目负责人 | 非品牌词点击、Google 选定 canonical、重点 URL 索引状态、四身份抓取一致(定义见 → 通用版 2.3 闸二:实抓的四身份(只读))、nosnippet 三兄弟本月有没有复发 |
| 9 | 项目负责人 | 下月工单 | 隔天自己再看一遍 | 走 7.3 分诊,产出下月三个点 |
| 10 | 出报告的人 | 月报 + 原始答案包 | 人逐页看 | 固定日期发 |
7.3 没动分诊与下月三个点
这一节要你做的:席位没超噪声带的那个月,手上多一份「停在第几层」的分诊结论,和按顺位机械排出的下月三张工单;再加一页固定格式的月报首页和一张只给自己看的对手榜。
触发条件只有一条
本月席位数增量未超噪声带 → 一律从第 1 层开始走,不许跳层。在册页数涨没涨,与本条无关。
为什么不能加「且在册页数没增加」:在册页数是你自己的施工产出,每月 +1 几乎是常态。把它塞进合取条件,等于给整张分诊表装了一个你随时能按的关闭开关,整季不会有任何一个月真正走分诊。触发条件里不许出现任何自己可控的变量,以后想加新触发条件,一律按这条审。
五层,从便宜查到贵
门与实体两层无条件查,是因为这两层的失败是静默的:页面根本没被读到、或 AI 认错了人时,席位数完全可能因为别的原因在涨,等下个月才发现,已经白做一个月。门层每个症状落到哪个修法,照 → 通用版 2.9 门层排查与本章验收 的两张诊断图查,这里不重画。其中三条最容易判错:Google 腿有席位而 ChatGPT 腿为零,先查 CSR,不查选题;别拿 GPTBot 当判据,它是训练爬虫,检索腿看 OAI-SearchBot 与 ChatGPT-User;别用 curl -A "OAI-SearchBot" 看返回内容下结论,两个方向都会判错。
| 层 | 当天查什么 | 判据与动作 | 月报里怎么说 |
|---|---|---|---|
| 1 · 门 | ① 访问日志:这几页 30 天内有没有真 OAI-SearchBot 命中、返回码是什么(唯一的直接证据)② nosnippet 三兄弟有没有被 CMS / 插件重新打开 ③ 四身份逐字一致 ④ site: 查 Bing 收录 ⑤ 在 ChatGPT 里贴 URL 让它逐字复述价格那一行 ⑥ Foursquare 类目与营业状态、Yelp 条目在不在 | 任一不过 = 门问题,不是选题问题:当天修,7 天后复检,本月不换题、不新增内容页 | 「上个月那几页 ChatGPT 根本没读到,原因是 X,今天已经修好,7 天后复检」 |
| 2 · 实体 | 品牌六问人读:说的是这一家吗?人名、地址、注册号、价格对不对?有没有同名混淆?有没有投诉 / 负面倾向? | 认错人或事实说错 → 页面工作全部归零重算,先修实体:六处可控源逐项打勾留截图(官网 /facts → Google 商家档案 → Bing Places → Foursquare → Yelp → Apple Business Connect)+ 向被引来源发纠错函。每条错误标明「第三方页面来源」还是「商家档案来源」,混在一起会让档案类错误系统性拖期 | 「AI 把你认成了另一家(或把你的价钱说错了),这个月先解决这件事」 |
| 3 · 引用位 | 本月被引次数前 10 的 URL(意图级),逐条对照夺取表的四列(四态 / 判定日 / 判定依据 / 判定人) | 当时判可进、现在入口没了 = 货架真变了 → 转「守」,去抢那个新来源,排本月站外工单第一条 当时判待问、或判定依据栏为空 = 判据漂移 → 当月补齐依据并重算弃权线,本月不算选点失误 意图级前 10 里够得着的 < 2 条 = 选点失误 → 这条意图移出主攻池换一条,已投的页转做长尾承接、不再加投 | 「A 上个月进了某某目录,把你从第 3 挤到第 5,这个月去打这个」 / 「上个月这条的判断依据没留下来,这个月补上再说」 / 「这道题的位置进不去,是当初选错了战场,换一条」 |
| 4 · 分界日与量具 | ① 页面上线不足两周 ② 上线后改过 URL ③ 冻结问句是不是裸词 ④ 引擎 / 型号 / 遍数有没有被动过 ⑤ 噪声带是不是比上月大 ⑥ 网页对照腿重叠率是不是 < 50% ⑦ 某条腿有效样本是否 < 计划量的 80% | 任一命中 → 分界日重算,或题池标「量具缺陷」,本月不计入「没动」。⑥ 命中的,本月席位结论一律加印不外推句(→ 通用版 4.4 网页对照腿与冻结基线(全书唯一完整规格)),且不许据此换题。「量具缺陷」这个免责连续两个月不许用第二次,第二次一律改为加遍数重测 | 「这一批页面上线还不满两周,下个月才到第一个可比点」 |
| 5 · 换题 | 1–4 层全通过,仍然没动 | 席位饱和或需求不真 → 这才是换题:回选题那一步重选,且必须换战场不是换措辞 | 「这道题的短名单被锁死了,换一个更进得去的战场」 |
两条纪律:
- 不得跳过 1–4 层直接写「需求不存在」。
- 连续两个月停在同一层未修复 = 执行的问题,不是货架的问题,下月插队处理,且不得再用同一条免责。
四态、弃权线与夺取表的定义见 → 通用版 4.6 四态、两层分母与弃权线 和 → 通用版 6.2 发信闸门、付费收录与夺取表。
分诊结果机械转成下月三个点
图上每一格怎么取那一条、派什么单:
| 顺位 | 取哪一条 | 下月工单 |
|---|---|---|
| 点 1 | 分诊第 1 层或第 2 层未通过 | 修门 / 修实体。一旦触发,自动占据第 1 点,且本月不新增内容页 |
| 点 2 | 本月被引来源里新出现、四态判「可进」、本侧可做、你不在册的来源 | 取本月实际被引过、被引次数最高、且对手进入方式 ≠ 平台自编条目的 1 条,派站外夺取工单 |
| 点 3 | 你已在册但位次在第 4 名之后的来源 | 取被引次数最高的 1 条,派更新函 / 补料工单。改位次比新进便宜(跨行业聚合口径、未在本地行业验证,印出时限定句原样带上;样本见 → 通用版 A.2 选点、写页、站外与复测的证据) |
| 顺延 A | 凑不满三条,内容形态是专业型 | 教育型厚页工单:把席位数最低的那条计费意图的承接页并入意图簇加厚。加到多厚按页型规格定,字数不是判据(→ 通用版 5.7 所有页型都成立的七条) |
| 顺延 B | 凑不满三条,内容形态是消费型 | 档案与事实工单:五处档案事实字段补满、/facts 页扩充、价格页逐项价补齐(写法按侧,→ 通用版 5.2 三侧速查(一):先判身份;价格、促销与赠送、结果数字)、官方与监管机构外链补齐。强监管侧不派评价工单——这一侧不得主动请求评价 |
| 顺延 C | 仍凑不满 | 价格页扩写:价格与费用类查询触发 AI 概览的比例高,证据见 → 通用版 A.2 选点、写页、站外与复测的证据 |
| 顺延 D | 仍凑不满 | 中文页补齐,或给已有厚页配一条本人口述长视频(→ 通用版 6.7 本人口述长视频) |
内容形态(专业型 / 消费型)是侧别判完之后的第二个判断,判法见 → 通用版 5.9 内容形态、FAQ、中文页与外语页。按形态分开顺延的依据是一份跨行业查询样本,未含新加坡,把握度约 75%,样本口径见 → 通用版 A.2 选点、写页、站外与复测的证据。
Reddit:按月读数,不写死结论
每月复测时读一次 Reddit 在本月被引来源里的占比 = 本月被引 URL 里 reddit.com 的条数 ÷ 本月被引 URL 总条数(两位小数,记进月报第二页)。
| 本月占比 | 动作 |
|---|---|
| > 2% | 本月排一条 Reddit 工单(进哪条腿就打哪条腿) |
| ≤ 2% | 本月不投入,只记数;下月再读 |
| 连续两个月 > 2% | 才允许把 Reddit 写进常规施工节奏 |
为什么不写死「不为 ChatGPT 投 Reddit」:ChatGPT 的 Reddit 引用出现过一次单月大跌,但同样的崩塌以前发生过并且完全恢复,而且 ChatGPT 并没有停止读 Reddit,停的是把线程放进答案——这是「答案面暂时收窄」,不是「这个来源死了」(数字与时间见 → 通用版 A.2 选点、写页、站外与复测的证据)。单月波动不写成长期纪律。
月报首页:三个确定性数,两个必须并印的口径
评价那一格按侧解释:不能主动请求评价的一侧,评价只作观测项;能请求的一侧,评价印在报告里,但不作主攻(各侧能做什么见 → 通用版 5.3 三侧速查(二):证言与评价、比较、榜单、头衔、外链、FAQ 与图注)。
月报第二页是对手榜:本月 AI 在推荐谁、谁上谁下、谁把你挤下来了(具体到哪一条问句、哪个来源页)、你的席位占比,以及对手进入方式(署名投稿 / 标注赞助或付费 / 平台自编条目 / 用户提交型档案 / 无法判断,五选一,全部从页面上可观测)。这一列每周顺手填,每条 2 分钟——对手已经替你把「这个货架上什么动作有效」试出来了,不填这一列,你只知道要进哪一页,不知道怎么进。月报首页样例与对手榜表头见 → 通用版 B.4 工单、台账与月报表头。
⚠️ 对手榜含第三方机构名称,是内部材料:不得用于任何广告、张贴、转发或公开传播。可对外的材料逐件标明。
7.4 守位与九十天结账
这一节要你做的:已经有位置的客户,手上多一份每月五项的守位清单和一句能对外说的话;第 13 周(D90)多一份诚实的前后对比,和一个照判据得出、不靠期待的去留结论。
守位:不做新增,只保住已有位置
- 第 ② 句认不认得你被问「X 靠谱吗」时 AI 怎么答
- 第 ④ 句事实对不对含价格有没有报错
- 第 ⑤ 句负面或排除有没有负面或排除倾向
- M 句M 句复测战场堆与守堆 M 句,同周重测出噪声带
- 站外对手与站外对手榜 + 站外三数
前三项是品牌六问里的三句(六问定义见 → 通用版 3.5 品牌六问与发现错误之后)。图画不出来的四件事:
- 每月跑什么:M 句 + 品牌六问(6 句 × 3 轮 × 2 引擎 = 36 次 / 月)× 同一组引擎,逐句原文归档;同周重测出噪声带;五处档案一致性复查。题目组成与轮次引擎一旦定下即冻结,本季不许改——改了前后两个月的事实错误条数就不可比。
- 怎么验:① 事实错误条数:基线 X 条 → 本月 Y 条,逐条附 AI 原文截图,任何人照着问一遍就能复现(X 只取冻结周那一次 36 次,→ 通用版 4.3 粗筛分堆、满轮与品牌六问基线)② 负面 / 排除倾向出现次数 ③ 档案一致性 5/5。
- 纠错:自己可控的源 3 个工作日内改完(官网事实页、五处商家档案)+ 向每一个写错的第三方页发出具名更正函并留档。第三方是否采纳、何时采纳由对方决定,不承诺,只承诺 +7 与 +21 两次跟进 + 月度复查。发现后 1 个工作日内通知相关方。
- 档案认领(一次性,约 2 小时):Foursquare + Yelp + Apple Business,全免费。把握度 70%——口径是免费、顺手做掉,不是「补了就会被 ChatGPT 推荐」。依据(ChatGPT 本地答案走哪几个数据源、哪年签的合作)见 → 通用版 A.1 机制、门与人这一层的证据,这条把握度的印法见 → 通用版 A.2 选点、写页、站外与复测的证据。
对外只说可验证的那一格:「基线时 AI 关于我们的事实说错 X 条,本月剩 Y 条,每条附原文截图,你自己照着问一遍就能复现。」 ❌ 不要说「90 天增量的大部分会落在品牌题上」——那是沙盘推演,不是实测(把握度 70%),只作内部参考。
为什么是九十天
公开口径:可见度一般两到八周才开始动,引用份额有意义的抬升要三四个月。席位留不住——同一个问题问三次,上次被引的来源只有极少数还在;一个答案的名额有限,同行一跟进就被抵消。所以这是持续占位,不是一次性施工;站外资产也会腐烂(→ 通用版 6.6 年度榜单与站外资产腐烂),这是唯一一条不用撒谎就能说的「为什么要继续做」。
三样各归各位
| 结账口径 | 是什么 | 强度 |
|---|---|---|
| 交付项清单 | 厚页上线并验收、认领型档案与法定册资料补齐可查、付费位上线、检索爬虫门修通并附实抓证据、逐月原文对照报告 | 可以当硬承诺:都在自己手里、可自行验证,不涉及对第三方引擎或第三方编辑行为的预测 |
| 席位数(前后并排 + 噪声带) | 起点 / 第 60 天 / 第 90 天三点,同一批问句、同一组引擎、同样遍数,逐条点数,同时印总名额、席位占比与本季实测噪声带 | 只并排列示,不承诺数值 |
| 在册页数 X/20(拆「在册」与「在册且被引」两行) | 分母为冻结的基线 Top 20 | 可作硬证据(页面上有就是有,不受抽样波动影响) |
Wilson 三态只出现在内部复盘页,对外最多作趋势描述。
⚠️ 席位数随遍数线性放大:基线 5 轮、D90 10 轮,什么都不做它也会翻倍,「席位增量 > 噪声带」就必然成立。所以遍数全季冻死,D90 一遍不加。要加遍数,只能另起一条新基线,并在同一页明写「与上一条基线不可比」;新旧两条不得相加、不得画进同一张趋势图。
D90 结账顺序
- 1三点对比起点、D60、D90,同题同引擎同遍数,0.5 d
- 2加样另存每句 10 遍 × 2 引擎,只出货架图与对手榜,1 d
- 3同周重测3 次,出本季噪声带,0.5 d
- 4点席位货架图起点 vs D90,含总名额,0.5 d
- 5在册终盘基线 Top 20 逐条截图,标两行,0.5 d
- 6停投清单累计问 30 次以上仍未被引的页停投
- 7公证抽样退出登录、真实浏览器、不超过十句,0.5 d
- 8写报告之前 / 之后 + 品牌单独结账,1.5 d
图画不出来的几条:
- 加样组存
probe_d90_wide/,与probe_d90/分开存;两者不许相加、不许并排进同一张趋势图,图上单独标注抽样规格。货架图是内部材料。 - 停投清单写进报告并说明原因。公证抽样不作头条数字,只作可复现性佐证。
- 第 8 段的「之前 / 之后」写四样:货架三个月前 / 现在;从哪些题缺席变成在场、哪些没动、为什么(引分诊停在第几层);对手位置变化;站外三数曲线。品牌单独一页:事实错误条数基线 X → 现在 Y,逐条附截图 + 一张《你自己照着问一遍》卡。
- 另有一份内部三态复盘(你的页与对照页前后差分),季度一次,不进月度流程,不对外。
结账判定
判据的完整写法:
- 继续扩:席位数增量 > 本季实测噪声带(必须同遍数、同引擎、同题池;本季若因任何原因加过遍数,这一格一律按「不可比」判,不得使用,改看在册页数),或在册且被引页数增加 ≥3。继续扩 = 换下一批题,重走选题与拍货架照。
- 转守位:交付全过、席位增量未超噪声带、在册也没增加、分诊 1–4 层全通过。停掉新增页面,只做上面的守位五项;报告明写「本季未能在主攻题上取得可判定的席位增量」,不粉饰。
- 先补交付:不拿可见度数字抵交付缺口。
- 选点失误:分诊停在第 3 层「引用位全在不可进来源」,这条意图整条移出主攻池,主动换题。不要把选点错误算成「这行业做不了」。
- 准入项:官网必须写出确定的、可核的价格,形态按侧别(→ 通用版 5.2 三侧速查(一):先判身份;价格、促销与赠送、结果数字 的价格图);始终不肯写、或始终改不了网站的,只做守位。价格页是自有站点少数能真进答案的格子,不给价格就等于放弃这一格。
- ⚠️ 强监管侧判准入看逐项确定价:这一侧「价格区间」的写法本身就不合规。据此判「不给价格」,会把一个其实合规、只是不能按通用模板写价的项目误判出局。
决定权在数据,不在期待。但「没效果」的定义必须是走完分诊、且席位变化超出噪声带之后的结论,不是量具分辨率不足的副产品。结账时不许对自己说这三句:
❌ 「再给三个月一定能涨」 ❌ 「行业平均要六个月」 ❌ 「数据在往好的方向走」(当席位增量未超噪声带、在册也没增加时)
7.5 量具纪律:换尺子就不可比
这一节要你做的:把「什么算换了量具」钉成一张对照表,把「基线该不该当月重冻」钉成一条机械判据。做完这一节,你手上有换尺子的处置办法、探针型号的锁定规矩、货架被批量改写时冻基线的两种办法,和一张哪些数能印、哪些只内部用的清单。
什么算换尺子
| 动作 | 后果 | 允许的做法 |
|---|---|---|
| 换引擎 | 换了量具 | 另起一条新基线,明写「与上一条不可比」 |
| 换 AI 型号(含小版本) | 换了量具 | 同上 |
| 换问法 / 换题池 / 换配比 | 换了量具 | 同上 |
| 换遍数 | 席位数线性放大 | 同上,且新旧不得相加、不得同图 |
| 换网页对照腿那 5 句 | 换了刻度尺 | 全季不换。要换,下一季换 |
| 换品牌六问的题数或轮次 | 事实错误条数前后不可比 | 全季冻结 |
跨版本只列数字,不算涨跌。两条不同基线的数放在同一页时,必须分两块印,中间隔一行「以下为另一把尺子」。这张表跟 7.2 的噪声带规矩是同一个判据的两个尺度:噪声带管的是同一把尺子内部的抽样波动,这张表管的是「你其实已经换了另一把尺子」的那些时刻。
探针型号:锁死,不跟主力漂移
跑探测用的模型型号固定,不跟随日常主力模型漂移。腿的名字照 7.1 叫,型号照下表锁:
| 腿 | 规矩 |
|---|---|
| ① OpenAI 接口腿 | 必须直连官方接口。它测的就是 ChatGPT——走任何中转 / 代理池,等于量了 A 去验收 B |
| ② Gemini 模型腿 | 可以走代理池(免费档直连额度不够时会整条腿打空,一条打不通的「高保真」通路不比一条打得通的代理通路更诚实)。走池必须 pin 死具体型号——浮动别名会 503,那一整个月的样本就没了 |
| 两条腿 | 型号只在明确决定时才动,且所有腿必须同步动。换型号 = 换量具,会让新报告和已经发出去的旧报告不可比 |
代价要写进报告口径:走代理池取样时,区域与模型小版本无法独立核验,这一句印在方法说明里。
基线该不该当月重冻,只看一条机械判据
为什么要这条判据:「分母全季不变」(7.1)和「基线不在货架集中改写的窗口冻结」两条合在一起会留一个洞——基线冻在某月,之后 Top 20 里的多数页被集中重写,分母已经和货架脱节,按纪律却不许换。图上那条判据就是补这个洞的(未实测,机制清楚)。
图画不出来的三点:「更新」只认 URL 上可见的更新日期,拿它与上次冻结日比;新旧两段的 X/20 不许画成一条折线;重冻当月的月报必须写明触发了哪几条 URL。
货架有预告式改写窗口时,两种冻基线的办法
有些货架有能提前预判的批量改写窗口:同一批来源集中在某个时间点前后重写,重写 = 候选集合被换掉(未实测,机制清楚)。窗口内冻基线,或基线与复测分属两个相位,量具当月等于失灵:涨跌全是窗口带来的,不是你做的事带来的。
无论选哪一种,都把冻结时所处的相位写进基线冻结文件首行,月度比对每行标相位;跨相位的数并排展示时,写明「不同相位,不可比」。为什么必须事先写死:这一条判错不会报错,只会让整月的报告写错方向——和判错门一样,代价不对称。
举例(电商)大促期间价格、库存状态、平台排序、买家搜索词同时变,两把席位的噪声带都会被撑爆。平日相位 = 大促前两周之外、大促后两周之外;复测窗口与基线窗口不在同一促销相位的那个月,一律写「未能判定(跨促销相位)」,不许写涨也不许写跌。
把握度不同,印法也不同
把握度低的照样做,只是印出来的时候要标,限定句原样带上。本章用到的说法,哪些印、哪些只内部用:
| 说法 | 印不印 | 怎么印 |
|---|---|---|
| 本月实测的噪声带 | 印 | 数值上月报第一页;第一次实测值拿到之前,席位数只并排列示、不作判定 |
| 五处档案补齐,ChatGPT 本地答案受益(来自公开合作关系) | 印 | 按「免费、顺手做」的口径说,不承诺效果 |
| 改位次比新进便宜 | 印 | 限定句原样带上:跨行业聚合口径,未在本地行业验证 |
| 顺延按内容形态分开走 | 印 | 带上「未含新加坡,把握度约 75%」 |
| 评价被逐字抄进答案的比例(外部实搜,样本极小) | 不对外印 | 只用来定施工方向;月报印你自己 M 句分推荐型 / 非推荐型两行的实测值,两行必须并列 |
| 90 天增量落在品牌题上的比例 | 不印 | 沙盘推演,非实测,只作内部参考(7.4 守位那句「不要说」) |
| 某条意图「点名 0 家、引用位已有人在抢」(外部实搜,一次性) | 不印具体数 | 只作内部排序;报告印你自己基线数出来的点名家数与引用位归属,标明重测日期与引擎 |
评价那一行要求两行并列,是因为只印推荐型那一行,会把人引去做强监管侧根本不能做的请评价动作。最后一行另有一条红线:❌ 任何材料里不得写「没人做」「竞争近零」。
每一条的百分比、样本与出处见 → 通用版 A.2 选点、写页、站外与复测的证据;数字怎么标、什么只能自己看的通则见 → 通用版 D.1 数字纪律:数字怎么标、什么只能自己看。