论文

SovereignPA-Bench:演化意图、平台中介与同意约束下用户自有个人智能体的评估

SovereignPA-Bench: Evaluating User-Owned Personal Agents under Evolving Intent, Platform Mediation, and Consent Constraints

智能体系统上下文与知识记忆Agent HarnessAgent任务评测Agent记忆

摘要

个人智能体正成为持久的用户自有中介:记住偏好、过滤平台中介信息、使用工具并与服务协商。既有基准评估工具使用、网页导航、桌面控制、个性化、推荐与演化上下文,却很少追问智能体是否维护用户主权:在尊重隐私、同意、证据、用户负担与抵抗操纵激励的同时推进用户当前利益。我们引入SovereignPA-Bench:在演化意图、平台中介、隐私边界、同意约束、证据要求与负担权衡下评估用户自有个人智能体的可执行基准。基准把智能体可见的ObservableState与仅评估者可见的HiddenLabels分开,报告任务成功、对齐、隐私、同意、证据、操纵、负担与可审计性的分量指标,并保留配对场景排序供模型与策略比较。跨4个模型家族与8个策略基线评估120个主权压力场景,产出3,840条冻结提示轨迹,附240项的三标注员盲审。完全主权脚手架较直接、仅记忆、仅同意、仅证据、ReAct/工具使用、安全提示与裁判护栏基线改善主权分数,同时降低隐私泄漏、同意违规、过度让步与操纵捕获。人工审计在隐私与同意上一致性高、在操纵上一致性较低——识别平台说服判断的主观前沿。结果表明个人智能体评估必须超越任务完成,走向代表性的、同意感知的、证据落地的行动。