论文
VeriScene:通过世界模型代理根据法律证据重建犯罪现场
VeriScene: Reconstructing Crime Scenes from Legal Evidence via World-Model Agent
摘要
世界模型采用文本、照片和图表等多模态输入,根据物理定律生成动态场景,从而开启了一个引人注目的应用:融合多模态法律证据来重新创建犯罪现场并重新制定犯罪的方式。然而,将原始的、无组织的证据输入世界模型在法庭使用中是失败的:它默默地丢弃证据,掩盖矛盾的证词,并产生违反证据记录的动议。本文介绍了 VeriScene,这是一个精心策划世界模型的代理:它根据法医照片和不同可靠性的证人证词重建犯罪现场,使每项主张都可追溯到证据,并且每项动作在物理上都是可信的。 VeriScene 在审核循环下迭代地将证据融合到引用的叙述中,通过具有纠正约束注入的世界模型中的探测性仿真轨迹来验证假设的动态,并将犯罪事件渲染为来自融合关键帧的重演视频。以 7 种物理驱动案件类型的 25 个犯罪场景为基准(139 张法医风格照片和 65 份植入不可靠的陈述),VeriScene 在 20 个测试场景中实现了 0.9014 的证据覆盖率和 0.7217 的事实一致性(0-1 范围),在事实一致性和准确性方面比端到端多模式 LLM 基线高出 20.35%。时间一致性为 34.88%,同时以每个场景 1.82 美元的价格推广到四个 LLM 编排后端。