TECHNICAL WALKTHROUGH / CHECKED

支付链路与弹窗策略实验技术执行说明

上下文策略 + 可复现实验回路

CURRENT IMPLEMENTATION

当前不是生成式对话模型,而是 show / delay / suppress / handoff 决策策略与固定种子 A/B 模拟。

AI 边界

不使用用户模型或真实转化数据;结果只来自合成人群模拟。

人工权限

实验负责人决定是否受控发布,并监控关闭率限制。

运行拓扑:用户如何抵达结果

页面负责收集与组装输入;合同、引擎和回执负责把边界变成可检查的执行链。

  1. 01

    页面交互

    表单式策略模拟器;不是 Chatbot,也不生成对话文案。

    当前执行
  2. 02

    PaymentDialogInput

    输入是漏斗阶段、触发原因、曝光、关闭和阻塞状态,不是自由文本对话。

    当前执行
  3. 03

    分阶段引擎

    上下文门 → 频控/冷却/阻断 → 稳定分桶 → 策略模拟 → 显著性与打扰护栏 → controlled rollout gate

    当前执行
  4. 04

    Dialog policy result

    JSON 返回动作、稳定分桶、模拟 uplift/打扰率和受控发布资格。

    当前执行
MODEL INPUT AND OUTPUT合同不接受

用户修改上下文字段,页面直接运行策略函数。

EXECUTION ORDER

页面把控件值序列化为 UserContext 和 simulation JSON。

模型、算法与工具逐项列账

模型名、规则引擎、检索器、评测器和控制层分开陈述;相似名称不等于真实调用。

contextual policy + z-test

当前执行

规则树决定弹窗动作,固定种子模拟和双比例检验评估策略。

由页面 Demo 或 POST /api/labs/:slug 同步调用;无外部推理请求。

Agent / Harness

Contextual policy engine

当前执行

decideDialog 把场景映射到明确 action 和 reason。

Data

Deterministic assignment

当前执行

稳定 subject hash 生成 bucket 与 variant。

Evaluation

Fixed-seed simulation

测试夹具

线性同余 RNG 使合成实验可复现。

Evaluation

Two-proportion z-test

当前执行

control/tiered 完成率产生显著性结果。

Control

Frequency cap

当前执行

三次曝光后 suppress。

Control

Dismissal cooldown

当前执行

24 小时内尊重用户关闭。

Control

Global kill switch

当前执行

开关覆盖全部策略为 suppress。

Agent / Harness

Release gate

当前执行

lift、打扰护栏和样本量共同决定 hold/eligible。

输入合同、分步执行与结构化输出

单次用户决策和群体实验是两个不同统计层,必须分开计算与解释。

INPUT

PaymentDialogInput

不读取聊天记录、截图或语音;生产事件流尚未接入。

  • context
  • simulation
  • subjectKey
  • killSwitch
  • dismissalGuardrailDelta
STAGED EXECUTION

上下文门 → 频控/冷却/阻断 → 稳定分桶 → 策略模拟 → 显著性与打扰护栏 → controlled rollout gate

  1. 01

    读取漏斗阶段、触发原因、曝光和阻塞状态。

    PaymentDialogInputUserContext

  2. 02

    按频控、冷却、主动任务和阻塞规则分层。

    UserContextrawDecision.ruleId

  3. 03

    用固定哈希分桶并模拟 control/tiered 两组。

    subjectKey + simulationassignment + experiment

  4. 04

    计算显著性、样本和打扰率发布门。

    experimentsimulation.releaseGate

  5. 05

    输出 show/delay/suppress/handoff 与 controlled-rollout 资格。

    releaseGatedecision + rollout decision

  6. 06

    记录转化、打扰、曝光缩减与实验限制。

    simulationmetrics + limitations

OUTPUT

Dialog policy result

一个用户上下文决策 + 一个合成人群策略实验。

  • decision
  • assignment
  • simulation
  • guardrails
  • releaseGate

Prompt 与 Schema 的四层装配

System、Few-shot、用户运行输入与输出格式分别标注;没有 Prompt 的项目不会假装存在 Prompt。

  1. 01

    系统约束

    没有 System Prompt;频控、冷却、kill switch 与发布策略承担系统约束。

    合同不接受
  2. 02

    少样本

    不注入 Few-shot。baseline / stress 只用于可复现测试,不进入模型上下文。

    合同不接受
  3. 03

    运行时输入

    没有 User Prompt;页面只提交枚举与数值字段。

    当前执行
  4. 04

    输出合同

    输出形状由 Zod + DialogDecision/PolicySimulation 与 TypeScript 返回契约决定,不靠 One-shot 示例暗示。

    当前执行

多模态准入矩阵:每一项都有明确状态

图片、音频、视频和数字人不会用空字段含混带过;未接入就明确写出未接入。

文本

当前执行

subjectKey 只用于稳定分桶,不作为自然语言语义。

表格 / JSON

当前执行

上下文和实验计数是结构化字段。

图片

合同不接受

严格 JSON 合同不接收图片;未知字段会被拒绝,不会保留空占位。

音频

合同不接受

没有音频上传、ASR 或声学特征管道。

视频

合同不接受

没有视频上传、解码、分镜或帧级推理入口。

数字人

合同不接受

没有数字人资产、驱动参数或渲染合同。

人工输入 / 复核

当前执行

实验 owner 决定受控发布;系统不触达真实用户。

用户在页面上操作,样本用于验证边界

预设不是替用户做决定,也不是偷偷注入 Few-shot;它让同一合同在基线与压力条件下可复现。

交互表面

表单式策略模拟器;不是 Chatbot,也不生成对话文案。

选择样本的目的

正常样本展示可触达策略;kill switch + 小样本专门证明抑制和 hold。

Kill switch + 小样本

STRESS TEST

关闭自助提示并把模拟样本降至合同允许的最小值。

提示被抑制,实验保持 hold

当前项目不建立外部聊天会话;页面输入进入严格合同,由规则、算法或确定性 Harness 执行。