TECHNICAL WALKTHROUGH / CHECKED

多智能体研究系统技术执行说明

Supervisor 编排的多角色研究图

CURRENT IMPLEMENTATION

Supervisor / Collector / Analyst / Writer 是确定性函数角色,不是四个独立 LLM。

AI 边界

角色不是独立 LLM;它们在本地合成知识库上执行显式函数。

人工权限

研究负责人复核来源覆盖、引用和最终发布。

运行拓扑:用户如何抵达结果

页面负责收集与组装输入;合同、引擎和回执负责把边界变成可检查的执行链。

  1. 01

    页面交互

    主题选择与 Agent 轨迹播放器;不是自由研究 Chatbot。

    当前执行
  2. 02

    MultiAgentResearchInput

    主题限定 growth/profit/risk;不是开放网络研究问题。

    当前执行
  3. 03

    分阶段引擎

    Supervisor 计划 → Collector 取证 → Analyst 计算 → Writer 绑定引用 → 覆盖率/step gate → 人工发布

    当前执行
  4. 04

    Research RunResult

    JSON 返回逐角色轨迹、证据 ID、计算、章节报告和覆盖率 gate。

    当前执行
MODEL INPUT AND OUTPUT合同不接受

用户触发角色图,没有外部模型对话。

EXECUTION ORDER

topic 枚举和复核字段直接进入执行图。

模型、算法与工具逐项列账

模型名、规则引擎、检索器、评测器和控制层分开陈述;相似名称不等于真实调用。

deterministic role graph

当前执行

按角色权限读取本地事实、计算指标、绑定引用并生成结构化报告。

由页面 Demo 或 POST /api/labs/:slug 同步调用;无外部推理请求。

Agent / Harness

Supervisor graph

当前执行

四角色按确定性工作流版本执行。

Control

Role-scoped permission metadata

当前执行

响应按角色声明权限,但没有独立工具沙箱。

Retrieval

Local knowledge base

测试夹具

collector 返回明确 evidence IDs。

Data

Calculator tool

当前执行

analyst 对收集事实做确定性计算。

Retrieval

Claim-citation binder

当前执行

writer 的章节主张绑定 citations。

Control

Post-run step budget

当前执行

trace 完成后检查是否超过 maxSteps。

Observability

Checkpoint label

当前执行

run/version/step 标签暴露状态,但不持久化。

Evaluation

Coverage release gate

当前执行

证据和引用覆盖决定发布/复核。

输入合同、分步执行与结构化输出

角色拆分把证据、计算和写作责任分开,便于检查每条结论从哪来。

INPUT

MultiAgentResearchInput

不上传报告或浏览网页;Collector 只读本地合成知识库。

  • topic
  • runId
  • maxSteps
  • reviewDecision
  • reviewRationale
STAGED EXECUTION

Supervisor 计划 → Collector 取证 → Analyst 计算 → Writer 绑定引用 → 覆盖率/step gate → 人工发布

  1. 01

    读取主题、run ID、最大步骤和人工复核决定。

    MultiAgentResearchInputresearch request

  2. 02

    collector 从本地 KB 收集证据 ID 和事实。

    research requestevidence pack

  3. 03

    analyst 计算指标,writer 绑定主张与引用。

    evidence packanalysis + draft

  4. 04

    包装四角色 trace、声明权限,并在运行后检查步数。

    analysis + drafttrace + checkpoint label

  5. 05

    输出研究报告或 needs-review。

    coverage metricsreport + gate

  6. 06

    保留角色 trace、checkpoint 标签和评审阻塞原因。

    reportrun lineage

OUTPUT

Research RunResult

一个受 step budget 限制的研究主题 run。

  • trace
  • facts
  • calculations
  • report
  • citations
  • coverage
  • releaseGate

Prompt 与 Schema 的四层装配

System、Few-shot、用户运行输入与输出格式分别标注;没有 Prompt 的项目不会假装存在 Prompt。

  1. 01

    系统约束

    没有 System Prompt;角色图、权限元数据、step budget 和覆盖率 gate承担系统约束。

    合同不接受
  2. 02

    少样本

    不注入 Few-shot。baseline / stress 只用于可复现测试,不进入模型上下文。

    合同不接受
  3. 03

    运行时输入

    topic 是受控路由键;Writer 由模板和证据函数生成报告。

    当前执行
  4. 04

    输出合同

    输出形状由 Zod + RunResult 与 TypeScript 返回契约决定,不靠 One-shot 示例暗示。

    当前执行

多模态准入矩阵:每一项都有明确状态

图片、音频、视频和数字人不会用空字段含混带过;未接入就明确写出未接入。

文本

当前执行

章节正文来自确定性模板与事实插值。

表格 / JSON

当前执行

facts、calculations、citations 和 trace 是结构化记录。

图片

合同不接受

严格 JSON 合同不接收图片;未知字段会被拒绝,不会保留空占位。

音频

合同不接受

没有音频上传、ASR 或声学特征管道。

视频

合同不接受

没有视频上传、解码、分镜或帧级推理入口。

数字人

合同不接受

没有数字人资产、驱动参数或渲染合同。

人工输入 / 复核

当前执行

研究 owner 提供批准/拒绝与充分理由。

用户在页面上操作,样本用于验证边界

预设不是替用户做决定,也不是偷偷注入 Few-shot;它让同一合同在基线与压力条件下可复现。

交互表面

主题选择与 Agent 轨迹播放器;不是自由研究 Chatbot。

选择样本的目的

三个主题对应不同事实/计算路径;无理由批准样本验证发布 gate,不是 Few-shot。

无理由批准

STRESS TEST

尝试批准报告,但不给出足够的复核理由。

报告不得发布

当前项目不建立外部聊天会话;页面输入进入严格合同,由规则、算法或确定性 Harness 执行。

继续检查原始产品证据

结果、运行台和案例仍保留在原项目页。

返回项目
NEXT WALKTHROUGH / 11
AI 协作分析

先运行确定性指标工具,再生成带图表引用的分析说明