论文

AI系统的情境感知部署前评估:面向尼日利亚金融科技的监管框架

Context-Aware Pre-Deployment Evaluation of AI Systems: A Regulatory Framework for Nigerian Fintech

模型评测安全与风险评测

摘要

商业大语言模型正日益部署于非洲金融科技基础设施中用于欺诈检测和客户沟通,但尚无尼日利亚或非洲大陆的监管文件明确规定此类系统在采购前必须经过何种部署前评估。本文综述全球、大陆和尼日利亚层面的非洲金融科技 AI 治理,表明安全被确认为原则,而部署前评估在操作层面未获具体规定。通用安全基准无法暴露该领域最相关的失败模式,因为它们既不含尼日利亚机构内容,也不测试对合法金融通信的假阳性误判。我们用 SafeAlert——一个专门构建的评估套件,应用于六个商业模型的三种系统提示条件——来论证上述主张。结果显示:能抵抗通用有害内容请求的模型在特定话术下仍会生成完整的诈骗脚本;多个模型把大多数合法的尼日利亚银行通信误判为可疑或欺诈,这是标准安全评估无法察觉的失败。文章最后提出监管框架,建议 CBN、NITDA、SEC 和非盟规定部署前评估要求,并论证所识别的缺口反映的是监管规范的缺失,而非技术或资金资源的短缺。