论文
TrajOnco:面向多癌种早期检测的纵向EHR时序推理多智能体框架
TrajOnco: a multi-agent framework for temporal reasoning over longitudinal EHR for multi-cancer early detection
摘要
从纵向电子健康记录(EHR)中准确估计癌症风险可以支持更早的检测和更好的诊疗,但对这种复杂的患者轨迹建模仍然具有挑战性。我们提出TrajOnco,一个免训练的多智能体大语言模型(LLM)框架,面向可扩展的多癌种早期检测。TrajOnco采用带长期记忆的智能体链架构,对顺序临床事件进行时序推理,生成患者级摘要、证据关联的理由和预测的风险评分。我们在去标识化的Truveta EHR数据上使用匹配的病例-对照队列对TrajOnco进行评估,覆盖15种癌症类型,预测1年内确诊癌症的风险。在零样本评估中,TrajOnco取得0.64至0.80的AUROC,在肺癌基准上与监督机器学习表现相当,同时展示出优于单智能体LLM的时序推理能力。多智能体设计还使较小容量的模型(如GPT-4.1-mini)也能进行有效的时序推理。TrajOnco输出的保真度通过人工评估得到验证。此外,TrajOnco可解释的推理输出可被聚合,以揭示与既有临床知识相符的人群级风险模式。这些发现凸显了多智能体LLM在纵向EHR上执行可解释时序推理的潜力,推动了可扩展的多癌种早期检测和临床洞见生成。
