用户修改上下文字段,页面直接运行策略函数。
支付链路与弹窗策略实验技术执行说明
上下文策略 + 可复现实验回路
当前不是生成式对话模型,而是 show / delay / suppress / handoff 决策策略与固定种子 A/B 模拟。
不使用用户模型或真实转化数据;结果只来自合成人群模拟。
实验负责人决定是否受控发布,并监控关闭率限制。
运行拓扑:用户如何抵达结果
页面负责收集与组装输入;合同、引擎和回执负责把边界变成可检查的执行链。
- 01
页面交互
表单式策略模拟器;不是 Chatbot,也不生成对话文案。
当前执行 - 02
PaymentDialogInput
输入是漏斗阶段、触发原因、曝光、关闭和阻塞状态,不是自由文本对话。
当前执行 - 03
分阶段引擎
上下文门 → 频控/冷却/阻断 → 稳定分桶 → 策略模拟 → 显著性与打扰护栏 → controlled rollout gate
当前执行 - 04
Dialog policy result
JSON 返回动作、稳定分桶、模拟 uplift/打扰率和受控发布资格。
当前执行
页面把控件值序列化为 UserContext 和 simulation JSON。
模型、算法与工具逐项列账
模型名、规则引擎、检索器、评测器和控制层分开陈述;相似名称不等于真实调用。
contextual policy + z-test
当前执行规则树决定弹窗动作,固定种子模拟和双比例检验评估策略。
由页面 Demo 或 POST /api/labs/:slug 同步调用;无外部推理请求。
Contextual policy engine
decideDialog 把场景映射到明确 action 和 reason。
Deterministic assignment
稳定 subject hash 生成 bucket 与 variant。
Fixed-seed simulation
线性同余 RNG 使合成实验可复现。
Two-proportion z-test
control/tiered 完成率产生显著性结果。
Frequency cap
三次曝光后 suppress。
Dismissal cooldown
24 小时内尊重用户关闭。
Global kill switch
开关覆盖全部策略为 suppress。
Release gate
lift、打扰护栏和样本量共同决定 hold/eligible。
输入合同、分步执行与结构化输出
单次用户决策和群体实验是两个不同统计层,必须分开计算与解释。
PaymentDialogInput
不读取聊天记录、截图或语音;生产事件流尚未接入。
contextsimulationsubjectKeykillSwitchdismissalGuardrailDelta
上下文门 → 频控/冷却/阻断 → 稳定分桶 → 策略模拟 → 显著性与打扰护栏 → controlled rollout gate
- 01
读取漏斗阶段、触发原因、曝光和阻塞状态。
PaymentDialogInput → UserContext
- 02
按频控、冷却、主动任务和阻塞规则分层。
UserContext → rawDecision.ruleId
- 03
用固定哈希分桶并模拟 control/tiered 两组。
subjectKey + simulation → assignment + experiment
- 04
计算显著性、样本和打扰率发布门。
experiment → simulation.releaseGate
- 05
输出 show/delay/suppress/handoff 与 controlled-rollout 资格。
releaseGate → decision + rollout decision
- 06
记录转化、打扰、曝光缩减与实验限制。
simulation → metrics + limitations
Dialog policy result
一个用户上下文决策 + 一个合成人群策略实验。
decisionassignmentsimulationguardrailsreleaseGate
Prompt 与 Schema 的四层装配
System、Few-shot、用户运行输入与输出格式分别标注;没有 Prompt 的项目不会假装存在 Prompt。
- 01
系统约束
没有 System Prompt;频控、冷却、kill switch 与发布策略承担系统约束。
合同不接受 - 02
少样本
不注入 Few-shot。baseline / stress 只用于可复现测试,不进入模型上下文。
合同不接受 - 03
运行时输入
没有 User Prompt;页面只提交枚举与数值字段。
当前执行 - 04
输出合同
输出形状由 Zod + DialogDecision/PolicySimulation 与 TypeScript 返回契约决定,不靠 One-shot 示例暗示。
当前执行
多模态准入矩阵:每一项都有明确状态
图片、音频、视频和数字人不会用空字段含混带过;未接入就明确写出未接入。
文本
当前执行subjectKey 只用于稳定分桶,不作为自然语言语义。
表格 / JSON
当前执行上下文和实验计数是结构化字段。
图片
合同不接受严格 JSON 合同不接收图片;未知字段会被拒绝,不会保留空占位。
音频
合同不接受没有音频上传、ASR 或声学特征管道。
视频
合同不接受没有视频上传、解码、分镜或帧级推理入口。
数字人
合同不接受没有数字人资产、驱动参数或渲染合同。
人工输入 / 复核
当前执行实验 owner 决定受控发布;系统不触达真实用户。
用户在页面上操作,样本用于验证边界
预设不是替用户做决定,也不是偷偷注入 Few-shot;它让同一合同在基线与压力条件下可复现。
交互表面
表单式策略模拟器;不是 Chatbot,也不生成对话文案。
选择样本的目的
正常样本展示可触达策略;kill switch + 小样本专门证明抑制和 hold。
Kill switch + 小样本
STRESS TEST关闭自助提示并把模拟样本降至合同允许的最小值。
提示被抑制,实验保持 hold
当前项目不建立外部聊天会话;页面输入进入严格合同,由规则、算法或确定性 Harness 执行。

