论文
CSEval:评估文本到图像生成临床语义的框架
CSEval: A Framework for Evaluating Clinical Semantics in Text-to-Image Generation
摘要
文本到图像生成正日益被应用于医疗领域的多种用途,如数据增强和教育。评估这些生成图像的质量与临床可靠性至关重要。然而,现有方法主要评估图像的真实感或多样性,未能捕捉生成图像是否反映预期的临床语义,如解剖部位和病理。在本研究中,我们提出Clinical Semantics Evaluator(CSEval),一个利用语言模型评估生成图像与其条件提示之间临床语义对齐的框架。我们的实验显示,CSEval能识别其他指标所忽视的语义不一致,并与专家判断相关。CSEval为现有评估方法提供了可扩展且具临床意义的补充,支持生成式模型在医疗保健中的安全采用。
