模型

GLM-5.3-FlashX高速模型API上线

概述

FlashX 是 GLM-5.3-Flash 的独立高速调用入口。每秒 Token 数描述生成速度,实际体验还取决于输入长度及首 Token 等待时间。 智谱为GLM-5.3-Flash推出独立FlashX模型代码,官方文档确认推理速度达200 tokens/s、1M上下文和多模态输入,API已可调用。