模型 / DeepSeek-V4-Flash-0731 (DeepSeek)

DeepSeek-V4-Flash-0731 (DeepSeek)

DeepSeek V4 系列轻量模型,本地快速对话

作者 lmstudio-community

仓库标识lmstudio-community/DeepSeek-V4-Flash-0731-GGUF

许可 可商用任务 文本生成最近核对 2026-08-05
运行时
OLLAMA
下载
113

Hugging Face 源仓库 ↗

快速上手示例

ollama run hf.co/lmstudio-community/DeepSeek-V4-Flash-0731-GGUF

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
这个GGUF量化版本可直接用LM Studio或llama.cpp跑起来,适合本地部署和快速体验DeepSeek-V4-Flash-0731。
适合
本地低延迟对话 / 日常聊天任务
不适合
复杂推理与长上下文

独立证据与社区反馈

10 个独立来源 · 另 1 官方/转载最近验证 2026-08-05

基准成绩大幅超越前代及 Pro Preview,与闭源旗舰有竞争力,但社区口碑两极分化:部分用户认为实际体验远不如基准亮眼,存在'刷榜'嫌疑,性价比和 API 速度有优势,但本地部署速度慢。

  • 多项基准超越 DeepSeek-V4-Pro (Preview),且激活参数更少
  • API 输出速度达 115.9 tok/s,显著高于同规模开源模型中位数
  • 智能体任务(GDPval-AA v2) Elo 从 1189 提升至 1559
  • 权重以 MIT 协议在 Hugging Face 完全公开,可本地部署
  • AA Intelligence Index 综合评分达 50,较上代 Flash 提升 10 分
  • 标准基准测试中与最强闭源模型具有竞争力
  • 代码相关评测:DeepSWE 54.4、Toolathlon 70.3、DSBench FullStack 68.7
  • 实际使用一致性不如基准表现,存在'benchmark maxed'嫌疑
  • 本地部署速度有限,IQ2_M 量化在双 3060 平台上仅约 3.5 tok/s
  • 部分社区用户认为实际价值被高估,不认可其热度
  • 规则与提示词跟随能力在 Preview 阶段已存在问题,社区反馈可能延续至 0731

可信度DeepSeek 官方模型社区 GGUF 量化,MIT 许可

完整规格

授权
MIT · 可商用
框架
llama.cpp / ollama / LM Studio
血统
量化自 DeepSeek-V4-Flash-0731
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 64.5k → 45.8k · likes +4

观测时间线

模型家族

查看全部家族 →