SummFlow 2026-07-01 Hugging Face

Agents-A1 (InternScience)

35B MoE Agent 模型,面向长程搜索、工程与科研

入选理由
35B MoE agentic模型,支持图像推理与工具调用,通过多阶段蒸馏实现复杂任务分解,适合开发者构建多模态agent应用。
对位
对位 Qwen3.5-35B-A3B / Nex-N2-mini
适合
长程搜索与多步推理 / 科学工具调用与科研
不适合
多模态视觉理解或生成
规模
35B · 262k · Q4 ~23GB / FP16 ~84GB
授权
Apache-2.0 · 需自查
框架
vllm / sglang
工具调用
qwen3_coder
可信度
Apache-2.0 许可,魔搭可下载,35B MoE 架构

仅 safetensors · 无 pickle 加载风险

社区实测

通过扩展训练任务长度而非参数规模,35B MoE 架构在多个长程智能体基准上达到甚至超越 1T 级模型水平,且支持单 GPU 部署。

  • 在 Seal-0、HiPhO、FrontierScience-Olympiad 等长程搜索与科学推理基准上取得 SOTA,超越 Kimi-K2.6、DeepSeek-V4-pro 等 1T 级模型
  • 35B 规模下支持通过 vLLM 单 GPU 部署,降低硬件门槛
  • Apache 2.0 开源,附带评估代码与技术报告,可复现
  • 社区讨论与真实用户反馈极少(相关 YouTube 评测仅 64 次观看、1 赞),缺乏实际使用中的踩坑记录

截至 2026-07-05

快速上手

vllm serve InternScience/Agents-A1 --max-model-len 262144 --reasoning-parser qwen3