8GB 显存能跑的语音识别模型
共 9 个
显存档为包含式:更低显存也能跑的模型一并列在此。数值取 Q4 量化后显存估算。
GigaAM-Multilingual (ai-sage) 70+语言语音识别,关注俄语、哈萨克语等小语种 GigaAM-Multilingual MLX INT8 (ai-babai) Apple Silicon 本地离线俄哈吉乌语 ASR,MLX 量化 GigaAM-Multilingual-MLX INT4 (ai-babai) 俄语及中亚语言离线语音转录,Apple Silicon 用 cohere-transcribe-arabic (CohereLabs) 阿拉伯语自动语音识别 (ASR) 模型 Nemotron-3.5-ASR-Streaming-0.6B (NVIDIA) 覆盖40种语言的流式ASR,600M,可调延迟,面向实时语音代理 Mega-ASR (THU) 面向远场、混响、重叠语音等严重声学退化的鲁棒语音识别 Whisper Large v3 MLX (mlx-community) Apple Silicon 上运行的 Whisper 语音识别模型 Whisper-large-v3-turbo (mlx-community) Mac端Whisper large-v3-turbo,MLX低延迟转写 XEUS (CMU WAVLab) 覆盖4000+语言的语音基础模型,供ASR/翻译微调