论文

从危险函数到语言空间:Cox 监督的 蒸馏 将生存风险转化为 大语言模型

From Hazard Functions to Language Space: Cox-Supervised Distillation of Survival Risk into a Large Language Model

摘要

我们研究了由 Cox 比例风险模型估计的事件时间风险信息是否可以转移到生成 大语言模型 中。我们提出了一种基于文本的生存建模流程,其中结构化临床协变量被转换为文本提示,并对基于 Qwen 的 大语言模型 进行微调,以使用 Cox 模型预测作为训练目标生成患者特定的生存风险。在 GBSG2、ACTG320 和 WHAS500 中,尽管模型被训练为文本生成任务而不是传统的生存分析损失,但仍实现了竞争性的保持区分和校准。我们进一步分析了模型隐藏状态的几何形状,其中 t-SNE 可视化揭示了潜在空间中的平滑风险梯度,表明该模型将生存风险表示为连续结构而不是孤立的风险类别。总之,这些发现表明 大语言模型 可以内化生存风险结构,同时支持校准预测,为语言模型中的事件时间推理提供一条途径。