返回全部项目
INDEPENDENT BUILD/ 2024

金融文档 RAG 问答

招股说明书、研报、年报跨文档检索与对比

RESULT / FIXED SAMPLE / 2026-07-17
抽取式回答已返回

客户集中度查询

前五大客户贡献 48% 收入、第一大客户占 19%,客户集中度较高;结论直接引用年报“客户结构”段落。

建议决策

返回抽取式答案和证据包,不生成法律或投资建议。

前五客户占比
48%

核心集中度结论

第一大客户
19%

来自同一证据段

顶部相关度
0.579

超过 0.08 门槛

检索证据相关度融合得分
客户结构0.579
风险因素0.405
研报风险0.152
募资用途0.069

结果边界作品集自建的合成年报、招股书与研报切片。

LIVE RUN / COMPLETE FLOWRUN / baselineDOES NOT WRITE TO EXTERNAL SYSTEMS

答案逐字来自哪一段,融合检索是否越过置信门?

页面先自动运行基准样本;也可以在下方编辑完整输入或执行项目专属压力场景。状态、指标、视觉和回执都来自当前 API 输出。

当前引擎状态

抽取式回答已返回

loadinghigh riskrate/
Top 融合分
校验中

BM25 + TF-IDF

output.diagnostics.topScore
分数间隔
校验中

Top 1 − Top 2

output.diagnostics.scoreMargin
Token 覆盖
校验中

查询命中

output.diagnostics.tokenCoverage
来源文档
校验中

合成语料

output.diagnostics.sourceCount
RESULT VISUAL

混合检索证据栈

verified fixed sample / evidence
  1. 01
    Top 融合分
    executed output / evidence 01
    校验中
  2. 02
    分数间隔
    executed output / evidence 02
    校验中
  3. 03
    Token 覆盖
    executed output / evidence 03
    校验中
  4. 04
    来源文档
    executed output / evidence 04
    校验中
LATEST RUN

业务决策、执行健康与发布回执

执行检查通过,只表示输出有效、未超预算且可以重放;是否发布仍由业务状态和发布检查决定。

正在加载合同并执行固定样本;超时会自动取消且不会产生外部副作用。
EDIT INPUT / RUN AGAIN

换一组输入,重新运行项目引擎

基准输入和压力输入都提交给同一版本 API。压力输入用于触发项目特定的拒绝、降级或复核规则,结果可以重复运行。

编辑完整 JSON 输入
REVIEW QUEUE / READ ONLY

下一步不是一个按钮

  1. P0
    EXECUTED
    抽取式回答已返回

    返回抽取式答案和证据包,不生成法律或投资建议。

    负责人 / 信用 / 投研分析师

  2. P1
    CONTROL
    DOC-Q01

    隔离 accession

    负责人 / 金融文档语料负责人

  3. P1
    DRILL
    文档权限泄漏

    立即关闭租户检索并通知安全

    负责人 / 平台 SRE / 安全

DATA SOURCES / THIS RUN

公开预览与本次运行分轨

  1. SOURCE 01disconnected preview

    EDGAR Submissions and XBRL Data APIs

    findoc.sec_document.raw.v1
  2. SOURCE 02disconnected preview

    Federal Reserve monetary policy press releases

    findoc.fed_release.raw.v1
  3. VALUES RETURNED BY THE ENGINE

    客户集中度查询

    本次计算只使用上方标明的数据版本;公开来源目前仅提供预览,尚未接入引擎。

FAILURE TEST / DESIGN ONLY

故障必须有检测和恢复路径

症状
用户看到无权限引用
检测
canary ACL query 和审计日志
隔离
立即关闭租户检索并通知安全
恢复
重建索引、验证删除并复盘
SYSTEM / FROM INPUT TO DECISION

信息从哪里来、怎样处理、何时调用工具,以及谁负责最后确认。

本地合成金融语料上的混合检索与抽取式回答。

AI 能力边界
没有 LLM 生成;回答直接取最高分 chunk,SEC/Fed 公开数据尚未进入索引。
人工责任
研究者核对来源、时效和跨文档结论。
01 / EXECUTED TRACE

信息处理顺序

source → context → intelligence → harness → decision → feedback
  1. 01
    信息进入

    读取查询、Top-K 和最小置信阈值。

    输入
    FinDocRagInput
    输出
    query contract
    • typed query
    • injection scan
    转换控制

    攻击输入直接 blocked-input。

  2. 02
    上下文构造

    CJK 分词并对 14 个本地 chunk 建立 BM25/TF-IDF 上下文。

    输入
    query
    输出
    hybrid hits
    • CJK unigram/bigram
    • BM25
    • TF-IDF cosine
    转换控制

    Top-K 限制证据规模。

  3. 03
    模型处理

    按 0.3/0.7 融合稀疏分数并计算置信/间隔。

    输入
    hybrid hits
    输出
    ranked evidence
    • hybrid fusion
    • score margin
    转换控制

    低于阈值时 abstain。

  4. 04
    运行约束

    执行注入、最小置信和 extractive-only 门。

    输入
    ranked evidence
    输出
    gate.decision
    • abstention gate
    • answer mode
    转换控制

    不能生成索引外答案。

  5. 05
    决策产物

    返回 top chunk 原文、citation 和 top-3 evidence pack。

    输入
    gate
    输出
    answer + evidencePack
    • extractive answer
    • citations
    转换控制

    无足够证据返回 insufficient-evidence。

  6. 06
    反馈回路

    暴露 fusedScore、token coverage、margin 和 source count。

    输入
    answer
    输出
    retrieval telemetry
    • retrieval diagnostics
    • corpus version
    转换控制

    当前没有用户反馈写回。

IMPLEMENTATION DETAILS / OPTIONAL

展开 8 个运行步骤、API 边界与实现状态

02 / RUNTIME CHECKS

运行时怎样限制模型和工具

运行图同时列出状态、预算、权限、失败处理、评测和人工审批。

编排H01
scan → tokenize → hybrid search → confidence gate → extract。
可检查证据runFinDocRag
状态与记忆H02
模块级索引固定 synthetic corpus 和版本。
可检查证据corpus + HybridIndex
预算H03
topK 与 14-chunk corpus 限制检索。
可检查证据topK + corpus.length
权限H04
本地只读检索;无文档写入或外部工具。
可检查证据sideEffects=none
护栏H05
注入扫描、minimumConfidence 和 extractive-only 联动。
可检查证据security + gate
失败与恢复H06
blocked-input 与 insufficient-evidence 是显式失败出口。
可检查证据gate.decision
评测H07
BM25、cosine、fused score、coverage 和 margin 可核对。
可检查证据hits + diagnostics
最终权限H08
研究者对来源真实性与结论负责。
可检查证据humanOwnerRequired
03 / API EXECUTION ENVELOPE

所有项目共享的运行边界

POST /api/labs/fin-doc-rag

这里说明 API 当前做到哪一步。页面演示可以观察底层函数,但不等同于已接入真实业务数据或外部写入。

运行姿态
DETERMINISTIC SANDBOX

18 个 API 引擎只读取请求并返回结果,不写入外部系统。当前未接入登录、审计数据库或线上业务数据。

入口契约
STRICT ZOD + 32KB

API 输入先经过严格 schema/default 标准化;HTTP JSON 请求上限 32KB。

执行预算
100–150MS / 256KB

每个项目单独设置耗时预算和 256KB 输出上限;超时会标记降级,非有限数和超大输出会被阻断。

回执与重放
CONTENT-ADDRESSED

回执包含输入/输出/idempotency hash、耗时和质量;尚无持久幂等存储或重复请求短路。

流量与身份
100/MIN / NO AUTH

当前使用进程内 IP 限流和公开 CORS;尚无登录、租户、角色或复核人身份。

页面与 API
TWO EXECUTION SURFACES

站内 Demo 多为底层引擎的直接交互;/api/labs 才增加完整输入校验、通用质量门与执行回执。

公开数据
LIVE PREVIEW / DISCONNECTED

页面可以预览官方端点的数据,但这些数据尚未保存、统一字段或通过质量校验,也不会送入项目引擎。

上线阻塞
OWNER + AUDIT + DATA + OPS

上线前还需要负责人签字、持久审计、全局限流、代表性数据验证、值班安排和回滚演练。

04 / IMPLEMENTATION STATUS

用了什么、解决什么、现在能否运行

每一项都写明它在当前引擎中的作用,以及属于实际执行、固定样本还是待实现设计。

当前项目技术证据矩阵
技术系统作用当前证据姿态
CJK tokenizerRetrieval把请求绑定到可检查的证据。中文单字和 bigram 同时进入索引。当前执行
BM25Retrieval把请求绑定到可检查的证据。词频/文档频率生成稀疏分数。当前执行
TF-IDF cosineRetrieval把请求绑定到可检查的证据。查询与 chunk 向量计算 cosine。当前执行
Hybrid rank fusionAI / ML执行评分、分类、传播或模型近似计算。BM25 0.3 + cosine 0.7。当前执行
Extractive answerAgent / Harness编排步骤、工具、状态和退出条件。答案严格复制 top chunk。当前执行
Evidence packObservability暴露版本、轨迹、原因和可复现证据。top-3 命中携带分数和 citation。当前执行
Prompt-injection scanControl限制权限、风险、发布或人工责任。可疑指令阻断检索。当前执行
Confidence / margin gateEvaluation量化质量、稳定性或统计可信度。最低分与头部间隔决定回答/弃答。当前执行
DIRECT ENGINE / OPTIONAL

检查底层函数,而不是重复主控制台。

完整 API 工作台已在上方;这里保留直接函数交互用于调试。

RUN THE ENGINE

直接观察项目的本地引擎。

页面 Demo 侧重底层函数交互;完整 /api/labs 包装另含严格输入校验、通用质量门和执行回执。

这是站内运行的工程沙箱:使用公开或合成样本执行真实算法;存在公开仓库时可继续查看源码。

RUNfin-doc-rag · 混合检索(BM25 + TF-IDF)

BM25 + TF-IDF 余弦两路信号融合(0.3:0.7)检索 14 个文档切片,答案抽取自最相关切片并标注来源。

CASE DETAILS / OPTIONAL

继续查看项目背景、架构和交付记录。

详细案例仍完整保留,但不再与运行结果争夺注意力。

职责
AI 产品 + 工程
年份
2024
交付方式
独立实现
运行定位
独立设计 / 可运行沙箱
CASE / 01

项目概述

系统用 BM25 和向量检索查询招股书、研报和年报,支持中英文问题。答案按主张列出引用、页码和置信度;没有足够来源时返回缺口,不补写结论。

CASE / 02

问题

P01

招股书、研报、年报跨文档查找耗时,关键信息散落在数百页 PDF 里。

P02

单一检索方式召回不全,答案缺引用、难以追溯与复核。

CASE / 03

架构与流程

architecture.diagram
STEP 01
分块编码

文档切片并编码

STEP 02
BM25 召回

关键词稀疏召回

STEP 03
稠密向量

语义向量召回

STEP 04
重排

0.3:0.7 混合融合

STEP 05
带引用合成

结构化 JSON + 引用

CASE / 04

核心功能

VIEW 01

混合检索

BM25 与向量按 0.3:0.7 融合,召回更全。

VIEW 02

跨语言查询

支持中英文混合提问。

VIEW 03

结构化输出

answer / sources / confidence 三段式 JSON。

VIEW 04

内联引用卡片

每条结论链接回原文片段。

CASE / 05

沙箱验证证据

11
监管文档

PBOC / SAFE / 人大等多来源。

0.3:0.7
混合权重

稀疏:稠密召回融合比。

JSON
结构化答案

答案 / 来源 / 置信度可追溯。

CASE / 06

使用的技术

BM25EmbeddingsHybrid RetrievalClaude APIPythonNext.js
IMPLEMENTATION DETAILS / OPTIONAL

展开数据、管道与生产控制。

SLO、权限、灰度、数据来源与故障恢复作为工程附录保留。

IMPLEMENTATION DETAILS

数据、管道与生产控制。

以下保留数据来源、运行限制和工程实现,不占用项目首屏。

DELIVERY / RESPONSIBILITIES·HIGH RISK

金融文档检索、比较与证据工作台

在文档权限、版本和证据边界内回答跨文档问题,并在证据不足时拒答。

RESPONSIBLE ROLE

信用 / 投研分析师

PIPELINE
5 STAGES
CONTRACTS
5 SPECS
QUALITY
4 RULES
PUBLIC DATA
2 FEEDS
架构和运行目标;容量与 SLO 是设计指标,不是线上实绩
文档切片
TARGET
50M

hybrid index

新增文档
TARGET
10 TB/day

OCR + parse

索引时效
TARGET
15 min

重大披露 2 分钟

沙箱语料
MEASURED
6 chunks

合成年报、招股书、研报

WORKFLOW

从接入到签署的责任链

  1. 01

    文档接入

    内容平台主管

    许可、病毒和哈希

  2. 02

    解析切片

    文档服务

    表格、页码和上下文

  3. 03

    权限索引

    搜索平台

    删除与权限实时传播

  4. 04

    混合检索

    RAG 服务

    BM25、向量和 rerank

  5. 05

    证据回答

    研究员

    抽取式、引用和拒答

TOPOLOGY

可替换服务与控制边界

EDGE
document-gateway

权限、许可和生命周期

SERVICE
parser-farm

OCR、表格和结构

STORE
hybrid-index

稀疏、稠密和 metadata

SERVICE
retrieval-api

rerank、预算和 evidence pack

CONTROL
deletion-ledger

删除证明与重建

下一个项目

支付风险监控助手