论文

人工智能科学家能改变主意吗?合成宇宙中的先验证据冲突

Can AI Scientists Change Their Minds? Prior-Evidence Conflict in Synthetic Universes

模型评测模型能力评测

摘要

科学Agent能否区分它从证据中推断出的规律和它仅仅认识到的规律?我们引入了合成宇宙,这是一个受控基准,它将规范的著名世界与由附近的非规范机制控制的匹配的扭曲双胞胎配对。我们对每个报告的定律进行两次评估:在保留的延续和传输设置上执行它,并独立检查它是否恢复生成机制。在一项预先指定的 60 细胞研究的当前检查点中,对 22 项试验进行了评分,另外一项试验以基础设施故障结束。在20个双胞胎试验中,8个通过了预测验证,5个恢复了发电机。这种分离是双向的:六个可解析输出成功预测但缺少机制,而三个恢复机制但预测rollout失败。阻力表现出第一种模式(5/5预测传递,1/5机制恢复);重力展示了第二个(1/5 预测传递,4/5 机制恢复)。由于匹配的著名对照、校正后的可识别性扫描和证据阶梯仍然不完整,因此我们不主张确认性因果先验冲突效应。相反,完成的运行建立了较窄的验证结果:预测充分性和机制恢复是不同的科学主张,需要不同的测试。