返回全部项目
INDEPENDENT BUILD/ 2025

多智能体研究系统

规划 → 检索 → 分析 → 撰写 四角色编排,对本地知识库真实计算

编排器将任务分配到三条受权限约束的工具路径,经过检查点和评测后汇入人工发布门
SYSTEM PORTRAIT / 03Agent Harness

三年增长研究样本

查看完整信息流
RESULT / FIXED SAMPLE / 2026-07-17
报告等待人工批准

三年增长研究样本

样本公司三年营收从 84.6 亿增至 128.4 亿,复合增长率约 23.2%;报告引用完整但证据广度仅 33.3%。

建议决策

结论可以阅读但不能发布,需由复核人批准并补足来源。

营收 CAGR
23.2%

2021—2023

引用覆盖
100%

无无引用段落

证据覆盖
33.3%

需要继续采集

营业收入趋势亿元
202184.6
2022114.6
2023128.4

结果边界合成公司事实;不含私有研究笔记或第三方研报正文。

LIVE RUN / COMPLETE FLOWRUN / baselineDOES NOT WRITE TO EXTERNAL SYSTEMS

四个 Agent 如何交接证据,哪些步骤和审批仍未完成?

页面先自动运行基准样本;也可以在下方编辑完整输入或执行项目专属压力场景。状态、指标、视觉和回执都来自当前 API 输出。

当前引擎状态

报告等待人工批准

loadinghigh riskrate/
步骤使用
校验中

预算上限 6

output.workflow.stepsUsed
证据使用
校验中

合成知识库

output.used.length
证据覆盖
校验中

已用 / 可用

output.diagnostics.evidenceCoverage
引用覆盖
校验中

报告段落

output.diagnostics.citationCoverage
RESULT VISUAL

研究 Agent DAG

verified fixed sample / network
步骤使用校验中证据使用校验中证据覆盖校验中引用覆盖校验中
LATEST RUN

业务决策、执行健康与发布回执

执行检查通过,只表示输出有效、未超预算且可以重放;是否发布仍由业务状态和发布检查决定。

正在加载合同并执行固定样本;超时会自动取消且不会产生外部副作用。
EDIT INPUT / RUN AGAIN

换一组输入,重新运行项目引擎

基准输入和压力输入都提交给同一版本 API。压力输入用于触发项目特定的拒绝、降级或复核规则,结果可以重复运行。

编辑完整 JSON 输入
REVIEW QUEUE / READ ONLY

下一步不是一个按钮

  1. P0
    EXECUTED
    报告等待人工批准

    结论可以阅读但不能发布,需由复核人批准并补足来源。

    负责人 / 战略研究员

  2. P1
    CONTROL
    RSR-Q01

    删除或重研究主张

    负责人 / 研究证据平台主管

  3. P1
    DRILL
    来源污染

    隔离来源并失效相关报告

    负责人 / 平台 SRE / 安全

DATA SOURCES / THIS RUN

公开预览与本次运行分轨

  1. SOURCE 01disconnected preview

    Crossref REST API

    research.crossref_work.raw.v1
  2. SOURCE 02disconnected preview

    OpenAlex Works API and snapshot

    research.openalex_work.raw.v1
  3. VALUES RETURNED BY THE ENGINE

    三年增长研究样本

    本次计算只使用上方标明的数据版本;公开来源目前仅提供预览,尚未接入引擎。

FAILURE TEST / DESIGN ONLY

故障必须有检测和恢复路径

症状
低可信文档进入研究集
检测
来源信任和内容注入扫描
隔离
隔离来源并失效相关报告
恢复
重新检索并由研究主管复核
SYSTEM / FROM INPUT TO DECISION

信息从哪里来、怎样处理、何时调用工具,以及谁负责最后确认。

确定性 supervisor/collector/analyst/writer 多角色研究图。

AI 能力边界
角色不是独立 LLM;它们在本地合成知识库上执行显式函数。
人工责任
研究负责人复核来源覆盖、引用和最终发布。
01 / EXECUTED TRACE

信息处理顺序

source → context → intelligence → harness → decision → feedback
  1. 01
    信息进入

    读取主题、run ID、最大步骤和人工复核决定。

    输入
    MultiAgentResearchInput
    输出
    research request
    • typed topic
    • review contract
    转换控制

    topic 和 maxSteps 由 API schema 约束。

  2. 02
    上下文构造

    collector 从本地 KB 收集证据 ID 和事实。

    输入
    research request
    输出
    evidence pack
    • local retrieval
    • evidence IDs
    转换控制

    只能访问角色许可的只读工具。

  3. 03
    模型处理

    analyst 计算指标,writer 绑定主张与引用。

    输入
    evidence pack
    输出
    analysis + draft
    • calculator tool
    • claim citations
    转换控制

    writer 不能访问未收集证据。

  4. 04
    运行约束

    包装四角色 trace、声明权限,并在运行后检查步数。

    输入
    analysis + draft
    输出
    trace + checkpoint label
    • role graph
    • post-run budget check
    转换控制

    权限和 retry 是可检查元数据,不是独立沙箱执行器。

  5. 05
    决策产物

    输出研究报告或 needs-review。

    输入
    coverage metrics
    输出
    report + gate
    • coverage gate
    • review status
    转换控制

    引用或证据覆盖不足不得发布。

  6. 06
    反馈回路

    保留角色 trace、checkpoint 标签和评审阻塞原因。

    输入
    report
    输出
    run lineage
    • execution trace
    • workflow metadata
    转换控制

    resumable 仅是状态声明,没有持久工作流运行时。

IMPLEMENTATION DETAILS / OPTIONAL

展开 8 个运行步骤、API 边界与实现状态

02 / RUNTIME CHECKS

运行时怎样限制模型和工具

运行图同时列出状态、预算、权限、失败处理、评测和人工审批。

编排H01
supervisor 顺序调用 collector、analyst、writer 并执行 gate。
可检查证据WORKFLOW_VERSION + runMultiAgentResearch
状态与记忆H02
checkpoint 是 run/version/step 数标签;没有持久状态后端。
可检查证据workflow.checkpoint + resumable
预算H03
maxSteps 在同步编排完成后与 trace.length 比较。
可检查证据budgetExceeded
权限H04
输出声明角色权限;底层仍是同一同步纯函数。
可检查证据workflow.rolePermissions
护栏H05
证据覆盖、引用覆盖、步数和人工理由共同控制发布。
可检查证据diagnostics + review
失败与恢复H06
step-budget-exceeded、insufficient-evidence、rejected 和 awaiting-review 可区分。
可检查证据diagnostics.gate
评测H07
evidenceCoverage 与 citationCoverage 逐节计算。
可检查证据quality
最终权限H08
研究负责人对最终外部发布负责。
可检查证据reviewerRequired
03 / API EXECUTION ENVELOPE

所有项目共享的运行边界

POST /api/labs/multi-agent-research

这里说明 API 当前做到哪一步。页面演示可以观察底层函数,但不等同于已接入真实业务数据或外部写入。

运行姿态
DETERMINISTIC SANDBOX

18 个 API 引擎只读取请求并返回结果,不写入外部系统。当前未接入登录、审计数据库或线上业务数据。

入口契约
STRICT ZOD + 32KB

API 输入先经过严格 schema/default 标准化;HTTP JSON 请求上限 32KB。

执行预算
100–150MS / 256KB

每个项目单独设置耗时预算和 256KB 输出上限;超时会标记降级,非有限数和超大输出会被阻断。

回执与重放
CONTENT-ADDRESSED

回执包含输入/输出/idempotency hash、耗时和质量;尚无持久幂等存储或重复请求短路。

流量与身份
100/MIN / NO AUTH

当前使用进程内 IP 限流和公开 CORS;尚无登录、租户、角色或复核人身份。

页面与 API
TWO EXECUTION SURFACES

站内 Demo 多为底层引擎的直接交互;/api/labs 才增加完整输入校验、通用质量门与执行回执。

公开数据
LIVE PREVIEW / DISCONNECTED

页面可以预览官方端点的数据,但这些数据尚未保存、统一字段或通过质量校验,也不会送入项目引擎。

上线阻塞
OWNER + AUDIT + DATA + OPS

上线前还需要负责人签字、持久审计、全局限流、代表性数据验证、值班安排和回滚演练。

04 / IMPLEMENTATION STATUS

用了什么、解决什么、现在能否运行

每一项都写明它在当前引擎中的作用,以及属于实际执行、固定样本还是待实现设计。

当前项目技术证据矩阵
技术系统作用当前证据姿态
Supervisor graphAgent / Harness编排步骤、工具、状态和退出条件。四角色按确定性工作流版本执行。当前执行
Role-scoped permission metadataControl限制权限、风险、发布或人工责任。响应按角色声明权限,但没有独立工具沙箱。当前执行
Local knowledge baseRetrieval把请求绑定到可检查的证据。collector 返回明确 evidence IDs。明确夹具
Calculator toolData规范化输入并生成可追溯的数据产物。analyst 对收集事实做确定性计算。当前执行
Claim-citation binderRetrieval把请求绑定到可检查的证据。writer 的章节主张绑定 citations。当前执行
Post-run step budgetControl限制权限、风险、发布或人工责任。trace 完成后检查是否超过 maxSteps。当前执行
Checkpoint labelObservability暴露版本、轨迹、原因和可复现证据。run/version/step 标签暴露状态,但不持久化。当前执行
Coverage release gateEvaluation量化质量、稳定性或统计可信度。证据和引用覆盖决定发布/复核。当前执行
DIRECT ENGINE / OPTIONAL

检查底层函数,而不是重复主控制台。

完整 API 工作台已在上方;这里保留直接函数交互用于调试。

RUN THE ENGINE

直接观察项目的本地引擎。

页面 Demo 侧重底层函数交互;完整 /api/labs 包装另含严格输入校验、通用质量门和执行回执。

这是站内运行的工程沙箱:使用公开或合成样本执行真实算法;存在公开仓库时可继续查看源码。

RUNmulti-agent-research · 编排引擎(真实计算)
01
Supervisor
02
Collector
03
Analyst
04
Writer
// 选一个研究问题,观察四个 Agent 真实执行(含 CAGR 计算 / 风险排序)
CASE DETAILS / OPTIONAL

继续查看项目背景、架构和交付记录。

详细案例仍完整保留,但不再与运行结果争夺注意力。

职责
AI 产品 + 工程
年份
2025
交付方式
独立实现
运行定位
独立设计 / 可运行沙箱
CASE / 01

项目概述

规划者、执行者和评审者按固定职责处理研究任务。MCP 根据任务选择检索或分析工具,页面保留每一步输入、输出和评审结果。

CASE / 02

问题

P01

单 Agent 处理长研究任务容易跑偏、上下文丢失,结果不可控。

P02

工具接入零散、缺乏标准与可观测,难以复用与调试。

CASE / 03

架构与流程

architecture.diagram
STEP 01
Supervisor 规划

拆解任务、分派角色

STEP 02
数据采集

Web 检索 / PDF 解析

STEP 03
量化分析

运行风险/数据模型

STEP 04
报告撰写

合成带引用的报告

STEP 05
状态机编排

有向图 + 断点续跑

CASE / 04

核心功能

VIEW 01

角色专精

每个 Agent 独立 prompt 与工具集。

VIEW 02

MCP 工具路由

统一工具参数,并按任务类型选择调用。

VIEW 03

断点续跑

中间结果缓存,可断点恢复。

VIEW 04

工具调用日志

实时观察每一步工具调用。

CASE / 05

沙箱验证证据

4
协作角色

规划 / 采集 / 分析 / 写作。

MCP
工具路由

统一参数格式,并按任务类型选择工具。

Resume
断点续跑

长任务可中断恢复。

CASE / 06

使用的技术

LangGraphMCPClaude APIPythonNext.js
IMPLEMENTATION DETAILS / OPTIONAL

展开数据、管道与生产控制。

SLO、权限、灰度、数据来源与故障恢复作为工程附录保留。

IMPLEMENTATION DETAILS

数据、管道与生产控制。

以下保留数据来源、运行限制和工程实现,不占用项目首屏。

DELIVERY / RESPONSIBILITIES·HIGH RISK

企业研究编排与证据生产平台

让规划、检索、计算、撰写和复核各自有权限边界,并让每个结论都有来源。

RESPONSIBLE ROLE

战略研究员

PIPELINE
5 STAGES
CONTRACTS
5 SPECS
QUALITY
4 RULES
PUBLIC DATA
2 FEEDS
架构和运行目标;容量与 SLO 是设计指标,不是线上实绩
研究任务
TARGET
20k/day

优先级队列

授权文档
TARGET
10M

租户 ACL

并行 Agent 步骤
TARGET
50

每任务预算

沙箱角色
MEASURED
4 roles

planner / collector / analyst / writer

WORKFLOW

从接入到签署的责任链

  1. 01

    任务规划

    Planner

    拆解和步骤上限

  2. 02

    可信检索

    Collector

    来源 allowlist 和 freshness

  3. 03

    计算分析

    Analyst

    公式与单位追踪

  4. 04

    证据写作

    Writer

    不能新增无引用主张

  5. 05

    研究审批

    研究平台主管

    明确 approve/reject rationale

TOPOLOGY

可替换服务与控制边界

CONTROL
orchestrator

DAG、预算和恢复

EDGE
source-broker

连接器权限和信任等级

SERVICE
analysis-sandbox

隔离计算和公式 trace

STORE
evidence-store

文档、切片和引用

CONTROL
review-console

版本差异与签署

下一个项目

AI 协作分析