论文
有能力却欠考虑:计算机使用智能体遵循情境完整性吗
Capable but Careless: Do Computer-Use Agents Follow Contextual Integrity?
摘要
计算机使用智能体(CUA)现代表用户在邮件、日历与待办清单等个人应用间行动。这种跨应用访问有用——但也造成基本被忽视的隐私风险:当智能体在一个上下文中工作时——它可能引入在该上下文中不恰当的另一上下文信息。因此——我们介绍AgentCIBench——评估框架——把该风险变成可执行、确定性评分的场景。我们针对CUA三种常见失败模式:视觉共位——智能体引入UI中紧邻任务目标的被禁项目;任务含糊过度分享——智能体对欠指定提示倾倒密集个人状态;接收者错位——智能体把内容发给对其不恰当的收件人。我们评估15个前沿智能体并发现惊人高的失败率:15个中11个在超50%场景上泄漏——平均泄漏67.9%——且当智能体在环境中端到端行动完成任务时同样的失败持续存在。我们发布AgentCIBench以鼓励更安全的计算机使用智能体开发——并把情境披露测试定位为部署前安全检查。
