论文
VeriTrace:类人的时序探索补全Agentic动作空间
VeriTrace: Human-Like Temporal Exploration Completes Agentic Action Space
摘要
大语言模型在自动化的Verilog RTL生成方面展示了潜力,但最先进的多代理系统在标准基准上达到95%的准确率。我们追溯这一天花板到一个不完整的调试行动空间:现有的系统限制了代理可以检查的信号,可以查询的时间窗口,或者两者,将调试限制为在狭窄、预先定义的视图下进行模式匹配,而不是基于假设的根因分析。我们提出了VeriTrace,这是一个多代理系统,其Inspector代理操作一个完整的调试行动空间,独立控制信号选择、时间窗口范围和迭代深度。这项能力,我们称之为Agentic Temporal Exploration,使代理能够形成关于失败原因的假设,查询波形以获取证据,并迭代性地提高其理解,这与人类验证工程师的探索性过程相呼应。VeriTrace在VerilogEval-V2上达到100%的Pass@1,这是第一个在这一基准上达到完美功能正确性的系统。在共享的Claude Sonnet 4.0基础上,VeriTrace超越了最强的再现基准+5.1%,表明调试代理闭合了最后的准确度差距。
