论文
梯度冲突能否预测理解与生成的权衡?统一多模态模型冲突指标的受控审计
Does Gradient Conflict Predict the Understanding--Generation Trade-off? A Controlled Audit of Conflict-Metric Validity in Unified Multimodal Models
摘要
统一多模态模型 (UMM) 越来越多地围绕理解和生成目标之间的梯度冲突进行设计。减少这些指标可以改善下游理解-发电权衡的前提从未被直接测试过。我们在受控测试台 GRIDUMM 中对其进行审核,该测试台反映了 UMM 训练的关键结构要素,同时使真实情况权衡完全可计算。在 63 个配置和 372 个测量检查点中,没有方向冲突度量达到 0.3 的绝对 Spearman 相关性,置信区间不包括训练期间测量的冲突与最终权衡的零。单调抑制冲突的剂量反应干预使权衡平淡,将相关性与因果关系分开。范数比是一个生成失败检测器,并且在主控生成的配置中变为空。功能干扰度量优于方向冲突度量,而训练损失则强烈跟踪这种权衡。我们的结果并非说明冲突毫无价值,而是表明:作为诊断目标,其有效性必须得到验证,不能直接假设,并且我们将审计协议作为可重复使用的标准发布。