论文

面向地方政府AI保障的生成式负责任AI数据评估模式(GRAIDES)

Generative Responsible AI Data Evaluation Schema (GRAIDES) for AI Assurance in Local Government

AI 基础设施可观测性

摘要

对生成式人工智能(AI)应用的信任依赖治理良好、可度量的性能与安全证据。但实践中——评估数据常碎片化于各系统间——结构不一致且难以比较。我们介绍生成式负责任AI数据评估模式(GRAIDES)——轻量开源数据模型——跨主流供应商集中AI可观测性。代码、架构与统计评估的实用蓝图作为组织级生成式系统保障方法的指导分享。报告来自威斯敏斯特市议会AI目录的示意性案例研究结果——聚焦测量人类-模型对齐——包括检测评估者间的系统性分歧。通过把评估框定为数据建模问题——GRAIDES为生成式AI系统提供迈向更一致、可复现基准、调参与保障活动的实用路径。