论文

ScholarStack:面向科学Agent的分层研究资产编排与跨任务复用

ScholarStack: Layered Research Asset Orchestration and Cross-Task Reuse for Scientific Agents

摘要

科学智能体支持一系列基于文献的研究任务,如检索、问答、证据支撑的生成和论断评估。然而大多数现有系统围绕单个任务组织:同样的论文被反复检索、切分和解读,一个任务中建立的理解难以在下一个任务中复用。我们提出 ScholarStack,一个分层研究资产框架,将论文集合编译为三个互补层级的可复用、可版本化、保留溯源的资产:基于原文的论文级论断、领域级的组织结构,以及基于证据的跨论文综合。统一的访问接口按每个任务所需的证据粒度返回任务特定视图,同时保留研究条件、来源可追溯性和验证状态。我们在横跨十个任务设定的四个任务族上实例化该框架,在相同基座模型下比较使用编译资产的智能体与任务特定基线。质量提升集中在需要跨论文证据的任务上,如多篇论文问答和文献综述生成;在所有测量的任务上,查询时的 token 成本均下降,资产一次编译、跨任务复用。这些结果表明,分层研究资产可以作为科学智能体的共享基础设施,把基于文献的辅助从孤立的文档处理转向累积式的、证据支撑的工作流。

ScholarStack:面向科学Agent的分层研究资产编排与跨任务复用:论文配图
图 1:ScholarStack 概览。知识构建将文档编译为有据可依的事实(L1)、领域组织(L2)与限定范围的跨论文综合(L3),并通过共享标识符和证据引用相互关联。在任务执行期间,智能体挑选并组合所需对象形成知识视图(Knowledge View),同时保留其条件、证据引用和已记录的验证状态。不同任务使用不同层次的子集与操作。反馈路径表示在通过适用检查后可选地注册任务衍生的候选条目;注册本身并不构成语义验证。