实验是否同时通过随机化、统计、实际提升和样本量检查?
页面先自动运行基准样本;也可以在下方编辑完整输入或执行项目专属压力场景。状态、指标、视觉和回执都来自当前 API 输出。
样本支持实验组
- 绝对提升
- 校验中
- p 值
- 校验中
- SRM p 值
- 校验中
- 80% power
- 校验中
B − A
output.result.absLift双比例检验
output.result.pValue随机化健康
output.diagnostics.sampleRatio.pValue每组需求
output.diagnostics.requiredPerGroup80Power实验决策漏斗
- 绝对提升校验中
- p 值校验中
- SRM p 值校验中
- 80% power校验中
业务决策、执行健康与发布回执
执行检查通过,只表示输出有效、未超预算且可以重放;是否发布仍由业务状态和发布检查决定。
换一组输入,重新运行项目引擎
基准输入和压力输入都提交给同一版本 API。压力输入用于触发项目特定的拒绝、降级或复核规则,结果可以重复运行。
编辑完整 JSON 输入
下一步不是一个按钮
- P0EXECUTED样本支持实验组
统计和实际提升门均通过;在补充业务护栏后可发布实验组。
负责人 / 实验平台主管 / 产品分析师
- P1CONTROLAB-Q01
隐藏效果并诊断
负责人 / 因果实验数据负责人
- P1DRILL分桶服务缺陷
停止实验并回基线
负责人 / 平台 SRE / 安全
公开预览与本次运行分轨
- SOURCE 01disconnected preview
Criteo Uplift Prediction Dataset v2.1
experiment.criteo_assignment.raw.v1 - SOURCE 02disconnected preview
KuaiRand randomized recommendation logs
experiment.kuairand_outcome.raw.v1 - VALUES RETURNED BY THE ENGINE
A=4,820 / B=4,790
本次计算只使用上方标明的数据版本;公开来源目前仅提供预览,尚未接入引擎。
故障必须有检测和恢复路径
- 症状
- 实验组比例或用户稳定性异常
- 检测
- SRM 和跨日 assignment hash
- 隔离
- 停止实验并回基线
- 恢复
- 修复后新建实验,不复用污染数据

