开源项目

NVIDIA发布NeMo-Speech.cpp:Nemotron语音模型的轻量C++运行时

NVIDIA/NeMo-Speech.cpp

AI 基础设施模型部署

概述

NeMo-Speech.cpp是NVIDIA发布的轻量原生C++运行时:面向Nemotron语音模型家族,提供跨硬件(广泛硬件支持)的本地推理能力与稳定的原生API,为多类语音模型(识别、合成等)提供统一运行时。仓库(仓库创建日,非功能发布日)。需要在边缘设备或本地服务器上离线跑语音模型、不想依赖Python栈的团队可评估其部署便利性;具体模型在各硬件上的性能表现需按目标设备实测。