火山引擎 AgentKit 全面升级:Identity/Runtime/Evaluation/Sandbox 四模块支撑企业 Agent 可靠、可控、可衡量
火山引擎Agent Infra升级,让Agent真正进入企业工作流
概述
在 FORCE 原动力大会上,火山引擎推出面向企业智能应用的 Agent Ready 基础设施,AgentKit 作为统一生产化底座全面升级,提供 Identity(身份鉴权)、Runtime(运行时)、Evaluation(评测)、Sandbox(沙箱)等模块,统一开发、运行、连接、治理与优化全链路能力,对应三大目标:可靠——通过 Runtime、Gateway、Memory 和 Knowledge,让 Agent 稳定运行、持续理解上下文并连接企业工具与系统;可控——通过 Identity、Policy、Guardrails 和 Sandbox,让 Agent 在明确的身份、权限、策略和隔离环境中执行任务;可衡量——通过 Evaluation、Observability,让 Agent 的依据、过程和结果可验证、可观测、可审计、持续优化。Identity 已接入数千家企业身份体系,支持飞书、钉钉、企业微信、自定义 SSO 及 OAuth、OIDC、SAML 等企业 IDP,通过用户组织管理、凭据管理和链式身份传递把用户、主 Agent、子 Agent、MCP 工具与企业系统串成可信调用链,Agent 不再继承用户全部权限而是在最小权限边界内完成任务。Runtime 与 Sandbox 强化三类能力:长程任务能力(Session 持久化、任务状态保存、上下文保留,配合快照、休眠和恢复)、规模化执行能力(云沙箱分钟级支撑 12 万沙箱并发)、多场景运行能力(远程 Skills 沙箱,原生支持 Codex、OpenCode 等编程类 Agent 沙箱并兼容 E2B 风格接口)。观测与评测侧升级四类能力:统一采集(一行命令接入 Claude Code、OpenClaw、Hermes 等主流运行时,采集 Agent 决策、工具调用、MCP 调用数据)、智能诊断(任务变慢、调用失败、成本异常时定位问题层级并给出根因假设)、一键评测(内置评测集自动运行并生成报告,支持多 Agent、多版本对比,可验证换模型、改 Prompt 后的效果变化)、数据回流(Trace、Session、失败案例、用户反馈自动沉淀为新评测样本)。