Nemotron-3.5-ASR-Streaming-0.6B (NVIDIA)
覆盖40种语言的流式ASR,600M,可调延迟,面向实时语音代理
仅 safetensors · 无 pickle 加载风险
社区实测
600M 参数可本地 CPU/笔记本运行的流式多语言 ASR 模型,社区已成功移植到 Apple Silicon(CoreML INT8/MLX)并验证 WER 与 fp32 基本持平
- 可在笔记本/CPU 本地运行,无需 GPU
- 端到端延迟低于 100ms,适合实时流式场景
- 单模型覆盖 40 个语言-地区变体
- 社区 Apple Silicon 移植(CoreML INT8/MLX)WER 与 fp32 参考偏差在 ±0.3 个百分点以内
- 社区 Apple Silicon 移植在 6 种语言中仅 5 种实现 bit-identical WER,存在个别语言差异
来源
NVIDIA Nemotron-3.5 ASR streaming, ported to Apple Silicon — runs on the Neural Engine, full WER parity vs fp32 : r/nvidianvidia/nemotron-3.5-asr-streaming-0.6b - Hugging FaceNVIDIA's Nemotron 3.5 ASR
截至 2026-06-19
快速上手
nemo_asr.models.ASRModel.from_pretrained('nvidia/nemotron-3.5-asr-streaming-0.6b')