论文
LLM 代理作为计算类型学家
LLM Agents as Computational Typologists
摘要
语言类型学依赖于专家对跨语言参考语法的分析,使得大规模的跨语言比较变得劳动密集型且不可扩展。我们介绍 AUTOTYPOLOGIST,一个 LLM 代理,用于对参考语法进行基于证据的类型学分析。该代理能够检索相关语法部分,分析行间注释文本 (IGT),并使用 ReAct 风格的工作流程对类型假设进行迭代推理。我们根据专家注释评估了类型学特征编码系统,并使用 25 种开源参考语法对类型学共性进行了类型学假设检验。在类型特征编码的不同信息约束下运行,智能体可以从参考语法散文中合成信息,但仍然面临着仅使用目标语言中的 IGT 的挑战。在类型假设检验中,智能体可以综合跨语言证据并识别支持案例和反例。这些发现表明 LLM 代理可以支持可扩展且可检查的类型分析,同时仍需要专家验证。