论文

Wyvern:生成有据多模态报告的Agentic框架

Wyvern: An Agentic Framework for Generating Grounded Multimodal Reports

摘要

在当前AI驱动的创新时代,知识增长不断加速,令人难以跟上。虽然生成式模型越来越多地被用于合成内容,但它们常常缺乏信息锚定(grounding)。为应对当下的这些特点,我们提出Wyvern,一个用于自动生成有据多模态技术报告的多智能体框架。Wyvern支持生成多模态输出,将图像、表格和带有支撑引用的文本整合进统一报告。此外,框架特别关注内容的锚定,实现了论断自动修订阶段。我们开展人工评估研究来评估所提框架的质量。结果显示,87%的案例中图表的信息量被认为优于近期基线。此外,在63%到100%的实例中,Wyvern的报告被评为比三种替代方法更有用。我们还进行了自动评估,显示Wyvern相对于基线在引用召回率上提升至多2.3倍,引用精确率提升1.6倍。

Wyvern:生成有据多模态报告的Agentic框架:论文配图
图1:Wyvern 主要功能概览