论文
摊销联邦适配:超网络驱动LoRA用于个性化
Amortizing Federated Adaptation: Hypernetwork Driven LoRA for Personalized Foundation Models
摘要
使用低秩适应 (LoRA) 的基础模型联合微调为分布式学习提供了一种高效通信的解决方案。然而,现有的联合 LoRA 方法存在两个基本限制:(1) 结构聚合偏差,其中独立平均低秩因子无法近似真实的组合更新;(2) 客户端初始化滞后,因为客户端在通信轮次中重复重新初始化 LoRA 参数,从而减慢收敛速度。我们提出了 HyperLoRA,这是一个统一的框架,通过超网络驱动的 LoRA 生成和产品空间聚合进行摊销联合适应来解决这两个问题。 HyperLoRA 采用学习生成器,将客户端分布签名映射到 LoRA 初始化,而不是针对每个客户端进行迭代优化,从而有效地分摊每个客户端的适应情况。在服务器端,我们引入了一个学习聚合模块,该模块直接合成低秩乘积空间中的更新,消除了逐因子平均的不一致问题。轻量级残差校正模块进一步提高了异构(非 IID)客户端分布下的稳定性。通过用学习算子取代迭代优化和启发式平均,HyperLoRA 共同实现了高效的个性化、无偏聚合和更快的收敛。联合视觉和视觉语言基准的实验表明,与之前的联合 LoRA 方法相比,HyperLoRA 实现了更高的收敛速度、对分布变化的更强鲁棒性以及更强的个性化性能。
