用户触发角色图,没有外部模型对话。
多智能体研究系统技术执行说明
Supervisor 编排的多角色研究图
Supervisor / Collector / Analyst / Writer 是确定性函数角色,不是四个独立 LLM。
角色不是独立 LLM;它们在本地合成知识库上执行显式函数。
研究负责人复核来源覆盖、引用和最终发布。
运行拓扑:用户如何抵达结果
页面负责收集与组装输入;合同、引擎和回执负责把边界变成可检查的执行链。
- 01
页面交互
主题选择与 Agent 轨迹播放器;不是自由研究 Chatbot。
当前执行 - 02
MultiAgentResearchInput
主题限定 growth/profit/risk;不是开放网络研究问题。
当前执行 - 03
分阶段引擎
Supervisor 计划 → Collector 取证 → Analyst 计算 → Writer 绑定引用 → 覆盖率/step gate → 人工发布
当前执行 - 04
Research RunResult
JSON 返回逐角色轨迹、证据 ID、计算、章节报告和覆盖率 gate。
当前执行
topic 枚举和复核字段直接进入执行图。
模型、算法与工具逐项列账
模型名、规则引擎、检索器、评测器和控制层分开陈述;相似名称不等于真实调用。
deterministic role graph
当前执行按角色权限读取本地事实、计算指标、绑定引用并生成结构化报告。
由页面 Demo 或 POST /api/labs/:slug 同步调用;无外部推理请求。
Supervisor graph
四角色按确定性工作流版本执行。
Role-scoped permission metadata
响应按角色声明权限,但没有独立工具沙箱。
Local knowledge base
collector 返回明确 evidence IDs。
Calculator tool
analyst 对收集事实做确定性计算。
Claim-citation binder
writer 的章节主张绑定 citations。
Post-run step budget
trace 完成后检查是否超过 maxSteps。
Checkpoint label
run/version/step 标签暴露状态,但不持久化。
Coverage release gate
证据和引用覆盖决定发布/复核。
输入合同、分步执行与结构化输出
角色拆分把证据、计算和写作责任分开,便于检查每条结论从哪来。
MultiAgentResearchInput
不上传报告或浏览网页;Collector 只读本地合成知识库。
topicrunIdmaxStepsreviewDecisionreviewRationale
Supervisor 计划 → Collector 取证 → Analyst 计算 → Writer 绑定引用 → 覆盖率/step gate → 人工发布
- 01
读取主题、run ID、最大步骤和人工复核决定。
MultiAgentResearchInput → research request
- 02
collector 从本地 KB 收集证据 ID 和事实。
research request → evidence pack
- 03
analyst 计算指标,writer 绑定主张与引用。
evidence pack → analysis + draft
- 04
包装四角色 trace、声明权限,并在运行后检查步数。
analysis + draft → trace + checkpoint label
- 05
输出研究报告或 needs-review。
coverage metrics → report + gate
- 06
保留角色 trace、checkpoint 标签和评审阻塞原因。
report → run lineage
Research RunResult
一个受 step budget 限制的研究主题 run。
tracefactscalculationsreportcitationscoveragereleaseGate
Prompt 与 Schema 的四层装配
System、Few-shot、用户运行输入与输出格式分别标注;没有 Prompt 的项目不会假装存在 Prompt。
- 01
系统约束
没有 System Prompt;角色图、权限元数据、step budget 和覆盖率 gate承担系统约束。
合同不接受 - 02
少样本
不注入 Few-shot。baseline / stress 只用于可复现测试,不进入模型上下文。
合同不接受 - 03
运行时输入
topic 是受控路由键;Writer 由模板和证据函数生成报告。
当前执行 - 04
输出合同
输出形状由 Zod + RunResult 与 TypeScript 返回契约决定,不靠 One-shot 示例暗示。
当前执行
多模态准入矩阵:每一项都有明确状态
图片、音频、视频和数字人不会用空字段含混带过;未接入就明确写出未接入。
文本
当前执行章节正文来自确定性模板与事实插值。
表格 / JSON
当前执行facts、calculations、citations 和 trace 是结构化记录。
图片
合同不接受严格 JSON 合同不接收图片;未知字段会被拒绝,不会保留空占位。
音频
合同不接受没有音频上传、ASR 或声学特征管道。
视频
合同不接受没有视频上传、解码、分镜或帧级推理入口。
数字人
合同不接受没有数字人资产、驱动参数或渲染合同。
人工输入 / 复核
当前执行研究 owner 提供批准/拒绝与充分理由。
用户在页面上操作,样本用于验证边界
预设不是替用户做决定,也不是偷偷注入 Few-shot;它让同一合同在基线与压力条件下可复现。
交互表面
主题选择与 Agent 轨迹播放器;不是自由研究 Chatbot。
选择样本的目的
三个主题对应不同事实/计算路径;无理由批准样本验证发布 gate,不是 Few-shot。
无理由批准
STRESS TEST尝试批准报告,但不给出足够的复核理由。
报告不得发布
当前项目不建立外部聊天会话;页面输入进入严格合同,由规则、算法或确定性 Harness 执行。

