模型

Mercury Voice面向企业正式开放:为语音Agent提供低延迟扩散语言推理

Introducing Mercury Voice

应用与实践模型推理智能体系统推理加速Agent 工具调用语音交互与综合语音服务

概述

Inception在开发方博客9月29日的对应文章中宣布Mercury Voice对企业客户正式开放,此前已有预览。它是为实时语音Agent优化的扩散语言模型,可处理长系统提示、推理和工具调用,提供128K上下文、最多50K输出及低、中、高推理力度,通过兼容OpenAI接口的Inception API嵌入LiveKit、Pipecat、Vapi或Retell等链路。模型负责语言推理与文本输出,不据名称推定具备原生语音识别或音频生成。官方在真实客服提示测试中报告完成推理后首个答案词元的中位延迟320ms、p95为750ms,不能混同首次预览或单个客户的170ms结果。标准价格为每百万输入/输出词元0.40/1.50美元,发布优惠为0.20/0.75美元,结束时间未明确。企业客户需联系销售获得访问。