开源项目

AgentSafeLabs/safelabs-eval:可运行的Agent红队测试与结构化安全评测系统

AgentSafeLabs/safelabs-eval

模型评测安全与风险评测

概述

AgentSafeLabs开源的safelabs-eval定位为Agent安全评测工程:一方面提供可运行的红队测试流程,对Agent展开对抗性探测;另一方面以结构化方式输出评测结果,便于横向比较与持续跟踪。对需要上线Agent并通过安全评估的团队,可作为自测基线参考。本次公开材料未披露支持的攻击类型与评分细则等更多细节。