论文
委托盲区:从Agent选择审计产品决策
The Delegation Blind Spot: Auditing Product Decisions from Agent Choices
摘要
成功的Agent执行未必能识别用户会珍视哪种未来产品改进。我们提出一种决策特定的审计方法,把声明的观测通道与产品价值对比映射到兼容区间与见证群体。其基础是既有的识别与决策理论;贡献在于一个可执行的测量工作流以及对其局限的受控研究。一个冻结实验在共享合成任务上向两个固定的模型快照发出4,800次请求。尽管执行准确率不同,全部36个保守主区间仍未得到解析。一项探索性的2,400次调用后续实验记录了供给的偏好,并为每个模型解析了九个比较中的三个。一个确定性抽取器在不调用模型、不做校准观测的情况下解析了九个中的七个,暴露了模型生成报告引入的不必要不确定性。进一步的14,400次受控多项式模拟区分了结构性歧义、弱识别与有限校准精度。我们提出带来源标签的决策回执,并提供一个用于检视审计的离线查看器。这些结果促使我们保留与决策相关的结构化输入,并在收集更多遥测数据之前先诊断决策为何未解析。该研究不含人类参与者或真实客户结果。完整证明、原始模型溯源、受控实验与可复现分析随报告一并提供。