技术实践

腾讯云复盘DeepSeek Harness试用中的异常Token消耗

智能体系统AI 基础设施Agent 动作执行与治理Agent Harness可观测性

概述

腾讯云产品团队试用DeepSeek Harness,让Agent分析如何开发一个DSH插件。输入只有几十个Token,使用的模型为GPT-5.6 Sol,但作者称不到五分钟费用已接近一千元。 团队展开执行链路和用量记录,发现后台启动十二个子Agent,并伴随规划、检索和多层调用。记录显示输入约1964万Token、输出约13万Token,cacheReadTokens持续为零。小输入因此并不代表低费用,判断任务成本需要观察实际展开的执行链路,而不能仅看用户最初输入。 团队进一步提出预算上限、费用预估、过程监控、异常告警、随时停止和成本说明等建议,但明确说明尚未实际实施。该案例属于工具试用中的异常费用复盘,不能写成已经开发插件或已完成费用治理部署;单次记录也不足以证明全部费用均由缓存失效造成。