论文

通用与皮肤病专用基础模型的跨分布评测

Bridging Research and Practice: A Systematic Evaluation of Generalist and Dermatology-Specific Models in Clinical Skin Lesion Classification

模型评测模型能力评测

摘要

机器学习在皮肤病学中的应用近年来显著增长,从概念验证走向潜在应用,但临床皮肤病学仍是困难且开放的问题。诊断常有歧义,皮损高度多变,采集模态、设备质量和患者人口差异进一步增加挑战,妨碍安全、公平临床使用所需的稳健模型。为支持研究转化,必须系统评估当代模型如何泛化到异构数据来源。我们在近期皮肤病数据集上比较多种架构,覆盖皮肤镜图像和手机临床照片,评估通用与医学视觉语言模型、基础模型的鲁棒性,并与包括嵌入方法和卷积网络的任务专属分类器比较。研究评估分布变化、模态变化和人口差异下的模型表现。通过量化当前最先进模型与临床部署要求之间的差距,我们希望推动可靠、可获取且临床适用的皮肤病AI系统。