论文
通用LLM作为人类驾驶行为模型:以简化汇入场景为例
General-purpose LLMs as Models of Human Driver Behavior: The Case of Simplified Merging
摘要
人类行为模型在自动驾驶车辆(AV)的虚拟安全评估中作为行为参照与人类智能体模拟的载体不可或缺,但现有模型面临可解释性与灵活性之间的权衡。通用大语言模型(LLM)提供了一个有前景的替代方案:单一模型有望无需参数拟合即可部署于多样场景。然而,LLM能捕捉与不能捕捉人类驾驶行为的哪些方面仍知之甚少。为填补这一空白,我们将两个通用LLM(OpenAI o3与Google Gemini 2.5 Pro)作为独立闭环驾驶员智能体嵌入简化的单维汇入场景,并用定量与定性分析将其行为与人类数据对比。两个模型都再现了人类式的间歇性操作控制以及对空间线索的战术层依赖。然而,两者都不能一致地捕捉人类对动态速度线索的响应,且两模型的安全表现差异悬殊。系统的提示消融研究显示,提示组件扮演模型特定的归纳偏置角色,无法在LLM之间迁移。这些发现表明,通用LLM有望在AV评估流水线中充当独立、开箱即用的人类行为模型,但仍需后续研究以更好理解其失败模式,并确保其作为人类驾驶行为模型的有效性。
