开源项目
VisionAsAdaptations:视觉隐式表示实现
microsoft/VisionAsAdaptations
概述
该仓库是论文Compression as Adaptation的官方实现,由剑桥大学与微软亚洲研究院合作,研究以扩散基础模型学习隐式视觉表示,把视觉信息压缩为紧凑表示用于重建,README称单个向量即可表示一幅480规格的图像信息。项目2月12日创建,采用MIT许可,提供图像与视频的训练及重建命令,流程可独立复现。研究视觉压缩与表示学习的团队,可复用其训练与重建命令,在自有数据上验证压缩率与重建质量。