论文

结合词汇、语义与修辞角色的印度法律先例检索

A Study of Prior Case Retrieval Using Lexical, Semantic, and Rhetorical Role Information in Indian Legal Documents

上下文与知识检索增强

摘要

对于检索印度法律判决中的先例,问题涉及将相关法律事实与单纯的词汇相似性区分开来,因为与查询判决共享法规的先例不一定相关。在本文中,我们描述了针对 IL PCR(印度法律先例检索)任务的三个连续检索系统设计的实证评估。我们证明,修辞角色(事实、决策比率、先例、参数、法规)的组合比使用单独角色或执行全文检索要好,法规相似性不具有歧视性,并且使用 LLM 生成的训练数据进行的法律蕴含重排序在官方评估方面比其内部验证分数要差得多。两名内部MRR高达0.97的排名者在官方评价中表现不佳(MRR低至0.14)。因此,我们提出了一种具有查询不相交分割和冻结验证融合的新设计。结果是具有 Micro F1 0.2549、MRR 0.6081 和 nDCG@10 0.4187 的四级管道。

结合词汇、语义与修辞角色的印度法律先例检索:论文原图
图 8:召回率 和 Micro F1 处于管道的连续阶段