论文

ULTRADISCOVERY:认知开放宇宙中的溯因探索

ULTRADISCOVERY: Abductive Exploration in an Interconnected, Epistemically Open Universe

智能体系统Agent任务评测

摘要

科学发现常始于散落的线索呼唤描述世界的新方式。这类溯因探索在认识开放时可能需要构建陈述解释所用的表征,在结构互联时需要组合散落各语境的证据。既有基准很少分开这两类需求或独立控制它们。我们提出ULTRADISCOVERY——五域交互世界:智能体修订一个初始成功的理论并预测未见跨域干预的结果。2×2设计使表征开放或披露、证据分散或对齐,潜在动力学固定。表征开放时,十一模型的智能体常撤回被教授的公理,无一引入未观察实体或重写替换所需的变量;披露使干预请求增至三倍并增加世界18个发现中的约一个,对齐增益更小;两个厂商Harness系统把发现带进更多域,其一在开放回合中重写了变量。没有任何系统在200次付费行动内做出精确预测;更大预算下双辅助出现一次精确预测,而每个开放回合都不精确。结果把困难定位在从积累证据到把它组合成可迁移表征的步骤。