论文

何时以及如何严重:驾驶 VLA 的特定场景安全范围

When and How Severely: Scenario-Specific Safety Envelopes for Driving VLAs

模型评测安全与风险评测

摘要

ISO 21448 (SOTIF) 下的视觉-语言-行动 (VLA) 驾驶规划器安全认证依赖于操作设计域 (ODD) 规范,该规范回答了两个互补的问题:规划器何时开始出现故障,以及一旦出现故障,故障的严重程度如何?我们在 15,968 对(剪辑、攻击)上评估了 Alpamayo R1(一款 10B 参数开放权重驱动 VLA)。我们发现了一个保守的总体差距:在 15% 平均位移误差 (ADE) 预算下,总体安全阈值为 $σ\leq 50$,掩盖了容忍测试网格顶部的良好采样场景 ($σ= 70$)。更改解释子集上的高斯混合模型 (GMM) 确定了六个离散严重性带(BIC 最优 $k{=}6$),因此具有相同平均误差的两个扰动条件在高严重性 (C4/C5) 故障中所占的比例可能存在重大差异。将同一语料库上的两项分析结合起来,发现两者都不是孤立的:噪声阈值最宽松的场景并不是高严重性率最低的场景:STOP_SIGNAL 集中了 LANE_KEEPING 的 C4/C5 份额的大约 $4\times$,尽管可以容忍更大的 $σ$。因此,用于驱动 VLA 的可部署 SOTIF ODD 规范需要二维安全范围,而不是每个危险的单个聚合值。