论文

语言模型可以分析数据吗?评估 大语言模型 在数据集上的问答功能

Can Language Models Analyze Data? Evaluating Large Language Models for Question Answering over Datasets

模型评测模型能力评测

摘要

本文研究了 大语言模型 (LLM) 在回答数据集问题方面的有效性。我们在两种情况下检查它们的性能:(a) 直接回答给定数据集文件作为输入的问题,以及 (b) 生成 SQL 查询以回答给定关系数据库模式的问题。我们还评估了不同的提示策略对模型性能的影响。该研究包括最先进的 LLM 和较小的语言模型,这些模型需要较少的资源并以较低的计算和财务成本运行。在包含不同难度问题的两个数据集上进行实验。结果证明了大型 LLM 的强大性能,同时凸显了更小、更具成本效益的模型的局限性。这些发现有助于更好地理解如何在数据分析任务中利用 LLM 及其相关限制。