论文
经TRIBE v2数据增广增强脑到图像解码
Boosting Brain-to-Image Decoding with TRIBE v2 Data Augmentation
摘要
大脑解码受到标记神经数据可用性的限制,并且在低数据情况下仍然具有挑战性。为了解决这个问题,我们研究是否以及何时可以通过使用预训练的 fMRI 对刺激反应的模型生成的合成数据来增强小型 fMRI 数据集来增强大脑解码。我们使用 TRIBE v2,这是一种大型编码模型,经过 1000 多个小时的 fMRI 对视频、音频和语言响应的预训练。对于每个数据集,我们评估系统网格,显示图像解码器的性能如何随着用于训练的合成数据量的变化而变化。我们的结果基于两个数据集(7T fMRI 自然场景数据集和 3T fMRI BOLD5000),显示与仅在真实数据上训练的解码器相比,Top-10 图像检索精度提高了 68%。重要的是,达到给定图像解码性能所需的增强数据的比例需要根据数据源进行调整。令人惊讶的是,专门针对合成 fMRI 进行训练的图像解码器在某些设置中的表现可以高于预期,这表明 TRIBE v2 可以支持零样本脑到图像解码。总之,这些结果表明功能磁共振成像对视觉、声音和语言响应的大规模模型如何为提高图像解码的数据效率提供基础。
