论文
推理中的跨LLM一致性:来自共享交互的证据
Cross-LLM Consistency in Inference: Evidence from Shared Interactions
摘要
大型语言模型 (LLM) 在架构、训练数据和优化过程方面有所不同,但它们仍然可能开发出类似的内部推理模式。在本文中,我们使用基于交互的解释来检验这一假设。我们发现,大语言模型在从相同的提示中预测相同的目标标记时经常共享交互模式。这种一致性在高级大语言模型中更为明显。共享交互也往往是低阶的,并且比非共享交互表现出更弱的正负抵消。这些结果表明,即使产生这种跨模型一致性的机制仍然开放,高级大语言模型可能会隐式针对常见推理模式进行优化。
