开源项目

How to Catch an AI Liar:提供欺骗检测器及跨分布评测

EleutherAI/how-to-catch-an-ai-liar

模型评测安全与风险评测

概述

该项目公开可运行的模型欺骗检测实现。它整理竞争实验中的检测器和27组分布评测材料,便于研究者复现。仓库项目用途依据公开文档介绍;具体支持范围及安装步骤按对应文档确认。检测表现依赖被测模型和分布,不能把特定实验成绩当作通用测谎保证。