此页是 2026-07-29 的观测快照,查看该模型当前信息 → /m/amd__instella-moe-16b-a3b-think/

归档 / 2026-07-29 / Instella-MoE-16B-A3B-Think (AMD)

Instella-MoE-16B-A3B-Think (AMD)

全开源 MoE 语言模型,16B 总参/2.8B 激活,面向研究

入选理由
全流程开放的 MoE 模型,含 Gated MLA 等架构创新,适合研究者深入分析训练阶段;需自行编写推理代码,且仅限研究用途。
对位
对位 DeepSeekMoE-16B(2.8B 激活)
适合
研究实验与训练流程复现 / MoE 架构与系统创新研究
不适合
生产部署或安全关键应用
规模
16B · 未知 · Q4 ~10GB / FP16 ~38GB
授权
ResearchRAIL · 需自查
框架
transformers / sglang
可信度
AMD 官方发布,提供预训练至 RL 全流程检查点,HuggingFace 57 点赞

仅 safetensors · 无 pickle 加载风险

评分详情

Q1
今天能接上用吗   3 / 5
Q2
有可信证据吗   1 / 5
Q3
是新东西吗   5 / 5
总分
9

HuggingFace 原始数据 (抓取于 2026-07-29)

作者
amd
任务类型
text-generation
推理库
transformers
下载
730
点赞
57
许可证
ResearchRAIL
标签
transformers, safetensors, deepseek_v3, text-generation, instella, moe, amd, rocm, conversational, custom_code, en, arxiv:2511.10628, license:other, text-generation-inference, endpoints_compatible, region:us

探索

源链接