论文
GPTKB 2.0:浏览、查询和审核消除歧义的 LLM 派生知识库
GPTKB 2.0: Browsing, Querying, and Auditing a Disambiguated LLM-Derived Knowledge Base
摘要
我们提供了一个网络演示,用于探索从 大语言模型 (LLM) 实现的大规模消歧知识库 (KB)。 GPTKB 2.0 包含超过 160 万个规范实体的 3840 万个三元组,以及 207.6K 合并关系和 66K 合并类。与之前主要通过表面字符串识别实体的 LLM 派生知识库不同,GPTKB 2.0 在递归知识库构建期间执行上下文引导的消歧,在引出事实时分离同音异义词并合并同义提及。该演示使该过程变得可检查:用户可以浏览实体、跟踪知识库中的链接并审核各个事实的出处,包括表面形式、候选匹配、源三元组和消歧决策。该界面还支持结构化 SPARQL 查询、翻译为 SPARQL 的自然语言问题以及从用户提供的文本到规范 GPTKB 2.0 条目的实体链接。 GPTKB 2.0 可从 https://gptkb.org/ 获取,完整的知识库可下载以供离线使用。