模型

LongCat-Flash-Lite 正式发布

模型推理推理加速

概述

美团LongCat正式发布非思考轻量MoE模型LongCat-Flash-Lite,为轻量专用型号,采用N-gram嵌入表及缓存、内核优化降低推理开销,支持代码与工具调用任务。模型总参数68.5B、每Token约激活3B,上下文长度256K,输入输出均为文本。接入方式有两种:权重及代码以MIT许可开放,可下载自行部署;同时提供API调用,可按成本与部署条件选择。