麦富迪 · 版本诊断先复核,别急着放量

窗口 2026-08-04 ~ 08-05(严格锁定)+该店自身 08-01 起 5 天序列做稳健性回调|对比 最优桶 / 基础版 / 直连人工组
转化口径为全渠道付款(当日成交 + 机器人促成 + 跟单 + 次日成交),并列单人产值(成交金额 ÷ 咨询人数,未成交计 0)
一句话:这店不是「负向」,但也不是能直接放量的「正向」。稳定形态是「笔数持平偏降、篮子变大」。
窗口内转化 +0.10pp、两段 p 均 >0.5,两桶统计等价;单人产值 +10.5 元(p=0.033)是本次实验唯一达到 95% 显著的结果。但把该店自己的 5 天序列拉出来,4 天转化略负、合计 −1.07pp,产值优势从 +22.5% 缩到 +9.8% —— 锁定窗口恰好包含了唯一那个转正的日子。净值取决于考核转化率还是 GMV。

两口径读数:转化持平,篮子变大

转化率 = 有对话的售前咨询人里,全渠道付款人数占比;单人产值 = 成交金额 ÷ 咨询人数(未成交计 0)。

成交人数
621
对照 600 人 | 转化 39.60% vs 39.50%(+0.10pp,不显著)
单人产值差
+10.5
57.1 vs 46.6 元 | +22.5%,p=0.033(本次实验唯一显著项)
客单价差
+22
144 vs 122 元 | +18.0%,笔数几乎不变但单笔更大
5 天序列转化差
−1.07pp
35.19% vs 36.27%(p=0.342)| 5 天里 4 天为负
咨询人数成交人数转化率转人工率机器人平均发言条数客单价单人产值
最优桶1,56862139.60%40.4%6.30144 元57.1 元
基础版1,51960039.50%39.2%5.32122 元46.6 元
直连人工组762836.84%100%1.00146 元53.8 元
这店的「负向」是口径造成的。首版只算当日成交,读数是 +0.59pp;补齐机器人促成、跟单、次日成交三条路径后变 +0.10pp,转人工段与纯机器人段的 p 值分别是 0.522 和 0.627 —— 两桶在窗口内统计等价。成交笔数几乎一样(621 vs 600),但篮子更大(客单 122→144 元),所以单人产值 +10.5 元。只看转化率会误杀这个版本;只看 GMV 又会高估它(见第六节)。
顺带证伪一条首版机制。首版猜「会话更长 → 决策拖到次日 → 次日付款被漏算更多」。实际该店次日独占付款(当日未付、次日才付)最优桶 1.48%、基础版 2.44%,方向与假设相反
直连人工组是该店最低转化(36.84%)。全程不让机器人接待并没有更好。样本仅 76 人、只作方向性参考,但三店方向一致。

前提体检:这店的前提最干净,问题只在窗口

成立
分桶是随机的
分流比例 50.79%,p = 0.378,未失衡。指标差异可以往下归因。
成立
两天各自完整
成熟运行中的实验,两天每日首请求均在 00:00 前后,两天符号相反且量级都在 ±1.3pp 内 —— 这本身就是「两桶等价」的旁证。
不成立
关键词意图标签可信
首版指认的失血口「纯图/链接」,该店有 94.6% 的买家其实发过明确文本诉求,只是词表没覆盖。它不是「低表达高意向流量」,就是普通的单属性提问。建立在它上面的唯一显著结论(−7.2pp)随标签一起作废。
日期基础版人数基础版转化最优桶人数最优桶转化差值(pp)
08-0477940.05%81338.75%-1.30
08-0575438.33%78339.59%+1.26

人数为「人·天」口径,跨天买家会重复计入,故与全窗口去重人数略有出入;桶内比较不受影响。

场景下钻:整体持平不是「什么都没发生」,是一涨一跌相互抵消

场景由买家首句原话按优先级规则归入,互斥不重叠。该店首句文本覆盖率在三店 94.5%-98.7% 区间内,不是抽样近似。

场景基础版人数基础版转化最优桶人数最优桶转化差值(pp)p最优桶转人工基础版转人工
选品适配与喂养44339.3%41739.1%-0.20.95527.6%27.8%
参数与信任凭证23730.4%27933.3%+3.00.47329.0%24.9%
其他无诉求16533.3%16240.7%+7.40.16553.1%48.5%
版本辨识与对比12449.2%12747.2%-1.90.75741.7%46.0%
试吃与退换保障11149.5%10853.7%+4.20.53938.9%36.0%
找货与货源落空8741.4%11029.1%-12.30.07260.0%57.5%
物流订单会员9446.8%10158.4%+11.60.10557.4%72.3%
价格活动与比价10847.2%8144.4%-2.80.70546.9%42.6%
症状驱动选品7534.7%9733.0%-1.70.81830.9%28.0%
直接要人工2937.9%3525.7%-12.20.29494.3%93.1%
品质异议与退换2425.0%2910.3%-14.70.15786.2%87.5%
整体1,51939.50%1,56839.60%+0.1040.4%39.2%
跌的一头:找货与货源落空 −12.3pp(p=0.072,折损约 13.5 人,且最优桶该场景占比还多了 1.3pp)。最优桶答不上来的比例 23.6%、基础版 18.4%,转人工 60% 也救不回来。买家问「这个没货了吗 / 怎么下架了 / 兑换不了 / 在哪买」,机器人回一句「抱歉没找到」就结束。这是真实的能力边界,不是促单问题。
涨的一头:物流订单会员 +11.6pp(p=0.105),而且是把转人工率从 72.3% 打到 57.4% 换来的 —— 机器人自己把发货时效、快递、改地址答了,既省人工又多成交。这是本次实验里唯一同时看到「降本」和「提转化」的场景,也是最该横向复制给另外两店的动作。
占 26% 的最大场景「选品适配与喂养」逐场景持平(−0.2pp,p=0.955),说明版本能力没有退化,与整体等价的结论自洽。结构 / 能力分解:能力效应 +0.69pp、结构效应 −0.42pp、交互 −0.16pp —— 买家来问什么两桶几乎一样

机制定位:两段都等价,没有可归因的失血点

把每桶拆成「转过人工」和「纯机器人走完」两段,再把最优桶的转人工占比固定回基础版水平做反事实。

转人工率转人工段人数转人工段转化纯机器人人数纯机器人段转化答不上来整体转化
基础版39.2%59541.0%92438.5%13.5%39.50%
最优桶40.4%63342.8%93537.4%13.8%39.60%
分段基础版最优桶差值(pp)p判读
转人工段41.0% (244/595)42.8% (271/633)+1.80.522等价
纯机器人段38.5% (356/924)37.4% (350/935)-1.10.627等价
转人工率差实际转化反事实转化(转人工占比固定回对照)结构贡献段内能力交互总差值
+1.2pp39.60%39.54%+0.03+0.04+0.03+0.10
这店没有可定位的失血点,因为整体本来就没失血。两段各自 p>0.5,反事实分解三项全部在 ±0.05pp 内 —— 转人工占比只差 1.2pp,怎么挪都挪不出东西。真正值得追的不是「哪里掉了」,而是客单为什么涨了 22 元(需外部核实是否来自搭配组合推荐,本次未取该字段)。

机会点折算:以对照桶同场景水位为目标

口径:以基础版同场景转化率为目标水位,算最优桶补齐差值可多产生的成交人数,按该店最优桶实际客单 144 元折算,只列差值为负且两桶合计 ≥60 人的场景。观测 2 天。仅供参考 · 不构成承诺值 · 不作考核依据。

场景分层最优桶人数缺口(pp)可补成交人数折日均日均 GMV 机会
找货与货源落空B11012.313.56.8975 元
直接要人工3512.24.32.1308 元
版本辨识与对比B1271.92.51.2179 元
价格活动与比价A812.82.31.1162 元
症状驱动选品C971.71.60.8117 元
选品适配与喂养B4170.20.80.457 元
合计(实验桶内)约 1,799 元/日

全店按实验桶约占售前流量一半放大 ×2 ≈ 3,600 元/日,其中「找货与货源落空」一个场景占 54%。仅供参考 · 不构成承诺值 · 不作考核依据。

稳健性与复核安排:窗口内的「正向」是选窗选出来的

5 天合计成交人数
1,280
对照 1,281 人 | 转化 -1.07pp(p=0.342),5 天里 4 天为负
5 天单人产值差
+3.7
41.6 vs 37.9 元 | +9.8%(窗口内是 +10.5 元 / +22.5%)
发言条数增幅
+18%
6.27 vs 5.23 条 | 5 天里 5 天都更高,从未翻转
日期基础版人数基础版转化最优桶人数最优桶转化差值(pp)基础版单人产值最优桶单人产值差值最优桶发言条数基础版发言条数
08-0165534.66%67333.14%-1.5234.1 元34.4 元+0.36.475.31
08-0266933.48%69131.55%-1.9328.1 元31.8 元+3.76.185.23
08-0367533.93%67731.61%-2.3232.3 元24.4 元-7.96.214.99
08-0477940.05%81338.75%-1.3145.1 元51.7 元+6.66.185.28
08-0575438.33%78339.59%+1.2647.4 元60.8 元+13.46.325.31
全序列3,53236.27%3,63735.19%-1.07 (p=0.342)37.9 元41.6 元+3.76.275.23
转化率的符号在 5 天里有 4 天是负的,只有 08-05 转正 —— 而锁定窗口恰好包含了这唯一一个正日。5 天并起来是 −1.07pp(p=0.342,仍不显著),方向从「+0.10pp 微正」翻成「−1.07pp 微负」。这说明锁定窗口的「两桶等价」是对的,「版本正向」是选窗选出来的。GMV 侧同理:08-05 单日 +13.4 元把窗口内均值拉到 +10.5 元(p=0.033),5 天口径只剩 +3.7 元。成交笔数 1,280 vs 1,281 —— 几乎一样多的单,最优桶多卖了 3.7 元/人,这才是真实画像。

动作

建「找货与货源落空」的兜底闭环(该店最大失血口,约 975 元/日机会)
现状:答不上来 23.6%、转化 29.1%、转人工 60%,回答「没找到 / 已下架」就结束。动作:缺货或下架判定后必须给同系列替代品 + 到货登记 + 兑换规则说明,禁止以「抱歉没找到」收尾。
把物流订单自助的做法整理成可复制方案(该店已验证)
该场景转人工 72.3%→57.4%、转化 46.8%→58.4%,只依赖订单数据、零商品知识依赖。这是三店里唯一被验证同时降本和提转化的动作,应作为标准方案输出给冠能与 toptrees。
B 层答完必须收口
选品适配、参数凭证、版本对比三档合计占该店大半人数,逐场景持平说明机器人答得住 —— 缺的是最后一句。动作:答完后追加「紧迫 + 背书 + 低风险」并主动收口,配套基建是商品结构化属性库 + 商品定位。

复核安排:要的不是更多样本,而是一个干净窗口

该店已有 3,637 / 3,532 人,样本足够;问题是锁定的两天在大促里。动作是取 8/10 之后的 5 个连续非大促日重跑同一套口径,主看两个指标:成交笔数差(现在是 1,280 vs 1,281)和单人产值差(大促窗口内 +10.5 元、5 天口径 +3.7 元)。
放量门槛:非大促窗口里单人产值优势仍 ≥ +3 元、且转化率不掉超过 1pp,就可以放量;否则按考核指标取舍。
仍需外部核实:客单 +22 元(+18.0%)是否来自搭配组合推荐 —— 需拉「一次会话内推荐商品数 / 成交商品数」验证,本次未取该字段。这条决定了「篮子变大」是版本能力还是流量结构波动。

口径纪律:转化率一律用全渠道付款口径;分子小于 20 的场景 / 分段不判显著,只列区间与真实对话。