HRM-Text-1B (sapientinc)
1B预对齐前缀LM,用前缀条件做结构化输出与推理
仓库标识sapientinc/HRM-Text-1B
显存未知许可 可商用任务 文本生成最近核对 2026-08-09
链接指向的配置 不在本页收录的形态里,已显示默认形态(原生)。
适合与不适合
独立证据与社区反馈
社区总体是「值得关注但保持谨慎」:HRM 这一架构方向在众多替代方案中被评价为「还算正经(fairly decent)」,但对 1B 模型是否真能成为新 SOTA 仍存疑。
- 以极低成本(40B token、约 $1k 预训练)训练出在 MATH/DROP 上声称超过 Llama3.2 3B 的小规模模型,满足社区对低成本小参数潜力的关注
- 开源了可运行代码而非只有论文,符合社区「有代码的预印本胜过无代码的同行评审」的一贯偏好
- 「新 SOTA 1B 模型」的说法被社区打问号,基准成绩尚未被独立复现,能否真正超越更大规模模型仍是开放问题
- HRM 是否真的是超越 LLM 的实质一步,社区(如 r/learnmachinelearning)仍在争论、未有定论
- 社区实测r/LocalLLaMA on Reddit: Sapient Intelligence releases HRM-Text 1B: 40B tokens, ~$1k pretrain, beats Llama3.2 3B on MATH and DROP
- 社区实测r/LocalLLaMA on Reddit: New SOTA 1B model? HRM-text
- 独立评测What is Sapient Intelligence & Hierarchical Reasoning Model (HRM) ?
- 社区实测The authors' code is at https://github.com/sapientinc/HRM . In fields like AI/ML... | Hacker News
可信度下载884次,点赞112;训练数据开源(data_io),许可证Apache-2.0
完整规格
下载动量
30天下载 26.3k → 27.4k · likes +12