论文

Notes2Skills:从实验室笔记本到具有确定性意识的科学代理技能

Notes2Skills: From Lab Notebooks to Certainty-Aware Scientific Agent Skills

智能体系统Agent Harness

摘要

科学发现工作流程在很大程度上依赖于实验室笔记,研究人员在其中记录观察结果、解释不确定的结果并计划后续实验。与精美的出版物不同,实验室笔记保留了不断发展的科学推理、隐性科学知识和作者的不确定性,使人工智能代理能够了解科学的过程。然而,大多数先前关于科学文本的工作都集中在论文、协议或结构化数据库上,而非正式的实验室笔记作为科学人工智能代理的输入尚未得到充分探索。这种差距很重要,因为实验室笔记中的隐性知识并不是作为一套干净的说明写成的:经过验证的观察结果、初步判断和可能的实验后续步骤经常出现在同一篇文章中。如果这些信号混为一谈,人工智能代理可能会将不确定的科学判断误认为是已确认的结论或可执行的行动。为此,我们提出了 Notes2Skills,这是一个两阶段框架,用于将实验室笔记本转变为科学人工智能代理的可验证技能,同时保留作者的确定性。在三个湿实验室会话和七个原始下游配置中,Notes2Skills 是唯一经过测试的配置,它可以避免观察到的制度级故障:对不确定的注释采取过度行动和缺少公司指令。我们证明,确定性保存是实验室笔记本和可靠的代理技能之间的一个关键缺失部分,为更安全的人工智能联合科学家系统开辟了一条道路。