模型

NVIDIA发布Nemotron 3 Embed多语言与代码检索嵌入家族

Nemotron 3 Embed模型家族发布

上下文与知识检索增强

概述

NVIDIA发布Nemotron 3 Embed模型家族:面向多语言与代码检索的嵌入模型,同批提供8B BF16、1B BF16与1B NVFP4(4比特浮点)三个版本,支持最长32K token输入,适合长文档与代码库检索场景。模型权重、训练数据集与训练配方全部开放。做企业检索、RAG与代码搜索的团队可将其纳入嵌入模型选型对比,官方称其在检索基准上表现领先;长输入场景的实际召回收益需按自有语料实测,NVFP4版本适合成本敏感的大规模部署。