Instella-MoE-16B-A3B-Think (AMD)
全开源 MoE 语言模型,16B 总参/2.8B 激活,面向研究
仓库标识amd/Instella-MoE-16B-A3B-Think
~9.5GB 4-bit许可 限制商用任务 文本生成最近核对 2026-08-05
适合与不适合
独立证据与社区反馈
「完全开放」标签有水分——授权仅限学术/研究用途,且 2.8B 活跃参数仍需 16B 量级的显存规划,离实用部署还有距离。
- 全流程检查点公开(预训练→中期训练→长上下文扩展→SFT→DPO→RL),便于研究复现和分阶段分析
- 使用开源 Primus 和 Miles 框架在 AMD MI300X/MI325X 上完成端到端训练,验证了 AMD 软硬件栈的可行性
- 在 AMD 自有 GPU 上从头训练出与 Gemma-4-E4B 可比的性能,为非 NVIDIA 生态提供了参考案例
- 授权协议限制仅用于学术和研究活动,任何商业用途均构成违规
- 2.8B 活跃参数仍需 16B 模型的显存规划,推理成本并不低
- 加载模型需要 trust_remote_code=True,存在安全和使用门槛
- 首选部署路径为 Linux,Windows 支持存在但非优先
- 独立评测Introducing Instella-MoE — ROCm Blogs
- 社区实测AMD Instella-MoE-16B-A3B : r/LocalLLaMA
- 独立评测AMD Instella-MoE: Research-Only Weights | Windows Forum
- 独立评测AMD unveils 'Instella-MoE' — GIGAZINE
- 官方/厂商amd/Instella-MoE-16B-A3B-Think · Hugging Face
可信度AMD 官方发布,提供预训练至 RL 全流程检查点,HuggingFace 57 点赞
完整规格
下载动量
30天下载 4.2k → 3k · likes +16