论文

面向智能合约翻译与质量评估的端到端 agentic 流水线

An end-to-end agentic pipeline for smart contract translation and quality evaluation

模型评测评测方法与指标

摘要

我们提出一个端到端框架,用于对从自然语言规范生成的 LLM 智能合约进行系统化评估。该系统将合约文本解析为结构化模式,生成 Solidity 代码,并通过编译与安全检查执行自动化质量评估。该流水线使用 CrewAI 风格的智能体团队并进行迭代精炼,产出带有完整溯源元数据的结构化工件。质量在五个维度上度量,包括功能完整性、变量保真度、状态机正确性、业务逻辑保真度和代码质量,并聚合为综合分数。该框架支持与真实标准实现的配对评估,量化对齐程度并识别系统性错误模式,如逻辑遗漏和状态转换不一致。这为智能合约合成质量的实证研究提供了可复现的基准,并支持向形式化验证与合规性检查的扩展。

面向智能合约翻译与质量评估的端到端 agentic 流水线
图2:面向智能合约生成、测试与部署的端到端智能体流水线架构。