增长黑客的一个优点是,即便失败的试验也能在极短的时间内给团队带来重要收获。《增长黑客》第四章 · 快节奏试验
220人划线 · 微信读书缓存(2026.09.20)
两次独立的假设试验,均随机分组、按人去重,每人观察满30天是否购买;按各自预定样本一次判读,不是同一试验中途加人再看。
事先约定:至少提高 2个百分点 才值得投入,即从10%到12%。
两次观测差都为零,精度却不同
甲 · 每组1,000人
对照:100 / 1,000=10%
新版:100 / 1,000=10%
提升=新版购买率 − 对照购买率
0 ± 2.63
个百分点 · 近似95%置信区间
+2仍在区间内 → 还不能排除
乙 · 每组10,000人
对照:1,000 / 10,000=10%
新版:1,000 / 10,000=10%
提升=新版购买率 − 对照购买率
0 ± 0.83
个百分点 · 近似95%置信区间
上限低于+2 → 有止损依据
横条=区间;虚线=+2个百分点。两图同尺,单位均为百分点。
置信区间体现估计的精度,不是“真实效果有95%概率落在里面”。甲既容得下损害,也容得下值得做的提升;乙已不支持预设的有价值提升,却不证明绝对零作用。
失败的学习价值,在于排除了什么。甲是证据不足,不代表必须继续烧钱;是否补试要另看成本,不能为了得到结论反复加样本。
听汇报时,问这一句
我们排除了多大的提升,还是只是没测出来?