论文
参考交流中 LVLM 的隐式与显式提示策略
Implicit vs. Explicit Prompting Strategies for LVLMs in Referential Communication
摘要
最近的两项研究 \citep{jones2026llms, zeng2026lvlms} 对于大型视觉语言模型(LVLM)是否可以与人类类似地协调有效的指称表达得出了明显矛盾的结论。我们控制研究之间的任务差异,同时直接比较它们的提示风格。我们重复了这样的发现:当 \textit{explicitly} 提示时,模型可以协调有效的引用表达式,这表明其他任务差异并不导致不同的结果。然而,我们还发现,相同的模型无法从更隐式的提示中推断出对沟通效率的需求,这凸显了人类和人工智能系统沟通方式之间的关键差异。