产品与服务

Amazon Bedrock 提供 GLM 5.3 托管推理与缓存接入

GLM 5.3 in Amazon Bedrock

AI 基础设施推理服务

概述

GLM 5.3 通过 Amazon Bedrock 提供托管访问,面向符合条件的企业客户,支持美国或全球跨区域推理配置。官方说明支持1M上下文、最高128K输出,始终启用推理并可选择推理努力级别。用户能够通过 OpenAI Responses/Chat 兼容入口或 Bedrock Invoke/Converse 接入,并使用显式提示缓存;缓存断点、最低token条件和接口支持范围需要按文档配置。Flex、Priority、Standard等服务选项为延迟、可用性和费用提供不同取舍。模型本身此前已发布,因此此次计为推理服务新增访问路径,而不新增一条首次模型发布;博客中的安全测试演示也不当作独立企业落地案例。