R Research Agent Lab 科研流程团队
公开只读 · 无 API
RESEARCH OPERATING SYSTEMPUBLIC SHOWCASE

把一个研究想法,
推进到可审计的论文候选。

这是一个面向计算机科研的多智能体协作团队。它把研究价值、文献证据、实验完备性、统计审计和投稿准备串成一条可追溯的工作链。

◈ 本站只展示预置运行回放,不接入任何个人权限、飞书数据或模型 API。
MISSION论文候选evidence first
01想法
02证据
03实验
04审计
从问题定义到提交前 Gate
每一步都有可验证产物
19专责 Agent
23阶段与质量 Gate
2模型路由
1最终目标:可投稿论文
WORKFLOW
VERSION 2026.09
01 / SCAFFOLD BRIDGE

从可复用的 Agent Runtime
到科研生产线。

智能体脚手架解决“如何配置、装配、运行和扩展”;科研平台把这些工程能力翻译成 Mission、阶段、证据和人工 Gate,让每一次协作都能留下可复核的中间产物。下方可切换查看设计图与执行框架。

ARCHITECTURE MAP / 01 工程骨架 → 领域语义 → 可审计科研流程
ENGINEERING FOUNDATION

智能体脚手架

把模型、Agent、工作流和运行入口拆成可组合节点,使用配置驱动装配出可复用的 Agent Runtime。

配置驱动节点化装配多模块工程
RESEARCH DOMAIN

科研流程平台

把研究目标拆成有 owner、有证据、有暂停条件的阶段链,驱动 19 个专责 Agent 协同推进。

Mission / StageEvidence / ArtifactGate / Human
脚手架能力核心组件科研平台语义
01配置层
AiApiNode · ChatModelNode模型、连接与工具配置
Mission Contract · scope_decision研究目标、范围、模型路由与主张上限
02装配层
AgentNode · WorkflowNode · RunnerNode按依赖关系构建 Agent 与编排树
19 个岗位 · 阶段 owner · Quality Gate把角色职责、阶段顺序和回退条件固定下来
03运行层
DynamicContext · Session · Plugin传递上下文、维护会话、记录生命周期事件
Artifact Manifest · Event Log · Human Gate沉淀交接包、状态变化、失败原因和人工介入点
04扩展层
MCP · Skills · ToolCallback接入本地、SSE、Stdio 等外部能力
文献检索 · 代码审计 · 数据与实验工具让科研 Agent 访问工具,但不越过权限与 Release Gate
科研平台运行语义同一套脚手架,在领域层展开为一条有证据的研究链
01目标Mission
→
02问题Problem
→
03证据Evidence
→
04假设Hypothesis
→
05实验Experiment
→
06审计Audit
→
07论文候选Candidate
Sequential 阶段依赖Parallel 证据并行Loop 失败修复与迭代Gate:证据不足就暂停
↗

一句话理解:脚手架负责把 Agent “装起来、跑起来、接起来”;科研平台负责规定“为什么做、做到哪一步、凭什么继续,以及什么时候交给人”。

图示是工程脚手架到科研领域的架构映射,用于解释复用关系;本站仍是预置回放和静态展示,不代表访客可以在线调用脚手架或提交真实研究任务。

02 / PRESET REPLAY

看一次完整的研究任务
如何被接力推进。

点击开始后,页面会播放一段来自真实验收流程的脱敏回放。它用于展示协作逻辑,不会实时调用任何 Agent。

MISSION REPLAYREADY / 预置回放
无网络请求 · 仅本地页面状态
PRE-RECORDED RUN LOG
2026-08-09 / E2E
↗OUTPUT等待回放
PENDING
03 / AGENT ARRAY

每个 Agent 都有清晰的
输入、输出与边界。

团队按研究阶段分组;重复性检索和核验走批量核验能力档,创意、判断、校准和设计任务走深度推理能力档。

04 / TEAM STANDARD

一条有 Gate 的研究生产线

Agent 不以“生成文字”为完成标准,而以证据是否足以支撑下一步为标准。

01

问题成立

先评估真实研究价值、近期先验和可投稿空间;无法形成论文路径的方向暂缓。

VALUE GATE
02

证据成链

把文献、假设、评测标准和 baseline 固化为有来源、可追溯的研究契约。

EVIDENCE PACK
03

实验全量

覆盖主实验、baseline、消融、稳健性、效率和失败分析,缺一项就不能宣称完成。

FULL MATRIX
04

结论受审计

独立复现、统计核验、证据对齐、同行评审和投稿检查共同决定是否可以进入论文版本。

SUBMISSION GATE
05 / TRUST & BOUNDARY

能力越清楚,
协作越可靠。

公开页面只呈现团队规范和脱敏结果;真实运行中的权限、文件和外部系统始终留在私有环境。

✓

可以做

  • 拆解研究任务并编排阶段
  • 检索、核验和组织证据
  • 设计全量实验与质量 Gate
  • 产出可审计的论文候选包
!

必须人工确认

  • 研究方向最终投入与停止
  • 高成本实验或资源申请
  • 论文版本、作者与 venue 决策
  • 任何真实投稿或公开发布
×

明确不做

  • 不伪造文献、baseline、指标或结果
  • 不把 dry-run 当作真实实验完成
  • 不代替作者承担学术责任
  • 不在公开站点暴露权限和数据
06 / ACCEPTANCE SNAPSHOT

真实跑过,
也真实知道哪里会停。

下方是 2026-08-09 的一次端到端受控验收快照。E0–E9 已完成协议级 dry-run;E10–E12 因外部资源与人工确认边界保留阻塞状态。

E0–E9 · PASSE10–E12 · BLOCKED
E0
Mission 建立与范围冻结协调、想法、价值与文献阶段进入受控回放
PASS
E1–E7
证据、实验、复现与审计链岗位覆盖与交接包结构已被验证
PASS
E8–E9
论文候选与提交前检查仅验证流程状态,不代表真实投稿授权
PASS
E10–E12
外部资源、人工 Gate 与完整实验按规范暂停,等待资源或人工确认
BLOCKED