Kimi-K3-0.40B (moonshotai)
轻量级Kimi-K3测试版,保留混合注意力MoE,用于特征提取开发
仓库标识inference-optimization/Kimi-K3-0.40B
~0.2GB 4-bit许可 可商用任务 向量嵌入最近核对 2026-08-05
- 格式
- 4-bit
- 文件
- ~0.2GB
- 运行内存
- ~0.2GB–0.3GB
- 运行时
- llm-compressor
- 下载
- 17,253
适合与不适合
独立证据与社区反馈
K3 在多项基准测试中成绩亮眼,社区普遍认可其前沿水平,但 2.8T 参数规模使本地运行几乎不现实,实际可用途径以 API 为主。OpenRouter 上多供应商竞争带来有竞争力的定价,但同价位下实测输出速度偏慢。
- 基准测试成绩跻身前沿,可对标 OpenAI 与 Anthropic 旗舰模型
- 支持 1M token 上下文窗口,适合长文档处理
- 提供 OpenAI 兼容 API,接入门槛低,无需自行部署
- OpenRouter 上 9 家供应商接入,可用性较高
- 开放权重(Modified MIT 许可),允许二次开发与自由部署
- 在独立基准排名中位列前茅(BenchLM #5/215, Artificial Analysis #4/189)
- 具备自主芯片设计能力,48 小时内从零完成芯片设计验证
- 2.8T 参数规模超出个人硬件承载能力,本地推理不可行
- 实测输出速度约 62 tok/s,低于同价位中位数 72.7 tok/s
- 在 UK AISI/CAISI 网络攻防评估中显著落后于前沿模型
- 训练依赖出口级 Nvidia 芯片及未公开的替代 GPU,算力受限
- 实际可行访问方式仅限于 API,本地推理不现实
- 社区实测r/AI_Agents on Reddit: Kimi K3 is the largest open-weight model ever released. You still can't run it.
- 独立评测Kimi K3 Benchmarks, Pricing & Speed (August 2026) | BenchLM.ai
- 独立评测Kimi K3 - API Pricing & Benchmarks | OpenRouter
- 独立评测China's Moonshot AI releases Kimi K3, the largest open-source model ever, rivaling top U.S. systems | VentureBeat
- 独立评测Kimi K3 Benchmarks: Moonshot's Numbers vs Independent Tests
- 社区实测r/LocalLLaMA on Reddit: Kimi K3 countdown has been released
- 社区实测r/singularity on Reddit: Moonshot AI (Kimi) office (presumably 2 days before the K3 launch). A $20B valuation startup. Not as flashy as SF rivals
- 独立评测China's 2.8-trillion-parameter Kimi K3 beats Claude Fable 5 in Frontend Code Arena benchmark— Moonshot AI delivers largest open-weight AI model ever, as China works around U.S. compute limits | Tom's Hardware
- 独立评测Kimi K3 Tech Blog: Open Frontier Intelligence
可信度HuggingFace 17k下载,基于moonshotai/Kimi-K3缩小,架构参数公开可复现
完整规格
下载动量
30天下载 84k → 59.7k · likes +6