产品与服务

火山引擎 Milvus Serverless:相对 Dedicated 实例创建提速 60 倍(3 分钟降至约 3 秒),按量计费并可缩容至零

秒级创建实例,火山引擎 Milvus Serverless 让 AI Agent 开发更快更省

AI 基础设施上下文与知识记忆向量数据库AI 开发与运维平台Agent记忆

概述

火山 Milvus Serverless 把开源向量数据库 Milvus 封装为开箱即用的云服务,面向 Agent 的记忆层需求提供四项能力:无服务器管理(平台负责实例部署、监控、运维与安全补丁全生命周期);弹性自动伸缩(按真实请求量实时扩缩计算与存储,可将资源缩容至零,按 QPS、向量规模驱动);按使用量付费(存储按业务真实写入数据量计费,数据放对象存储;计算按读写请求次数、写请求数据包大小、读请求查询关联数据量计费,无请求零费用);实例秒级创建(Milvus Serverless 实例是物理集群上的一个逻辑集群,对应物理集群上的一个 db,创建只需划分 db、分配 user、配置权限、打通网络,无需拉起集群节点,相比 Dedicated 实例创建提速 60 倍,耗时从 3 分钟降低到 3s 左右)。接入侧给出 Pymilvus 的最简样例:控制台获取 URI 与账密后用 connections.connect 接入,创建名为 agent_memory 的 Collection(dim 768、FLOAT_VECTOR),建 AUTOINDEX 索引并 load,写入记忆数据后用 collection.search 做向量检索;文中称整个接入过程不超过 1 分钟。目标场景包括 RAG、智能客服与虚拟助理、内容推荐与语义搜索、多 Agent 复杂工作流协作中的分段记忆存储。