模型

NVIDIA 开放 Nemotron 3 Nano 4B 端侧模型

Nemotron 3 Nano 4B开放发布

模型优化模型压缩

概述

NVIDIA 于2026年3月16日发布面向端侧智能体的Nemotron 3 Nano 4B语言模型,属于专用轻量版本。模型参数3.97B,由Nemotron Nano 9B v2压缩而来,采用Mamba2与Transformer混合架构。上下文长度最高262K tokens,输入输出均为文本。模型可用于本地工具调用、语音助手和自动化任务,以NVIDIA Open Model License开放权重。