模型 / HRM-Text-1B (sapientinc)

HRM-Text-1B (sapientinc)

1B预对齐前缀LM,用前缀条件做结构化输出与推理

作者 sapientinc

仓库标识sapientinc/HRM-Text-1B

显存未知许可 可商用任务 文本生成最近核对 2026-08-09
运行内存
权重格式未知,无法估算显存
运行时
transformers
下载
884

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

适合与不适合

入选理由
需手动安装最新transformers,有示例;HRM循环架构。
对位
对位SmolLM2-1.7B、Qwen2.5-0.5B等小型预训练LM
适合
Few-shot 直接答案提取(direct前缀) / 复合条件 CoT 推理(synth,cot前缀)
不适合
聊天对话与代码生成

独立证据与社区反馈

4 个独立来源最近验证 2026-08-09

社区总体是「值得关注但保持谨慎」:HRM 这一架构方向在众多替代方案中被评价为「还算正经(fairly decent)」,但对 1B 模型是否真能成为新 SOTA 仍存疑。

  • 以极低成本(40B token、约 $1k 预训练)训练出在 MATH/DROP 上声称超过 Llama3.2 3B 的小规模模型,满足社区对低成本小参数潜力的关注
  • 开源了可运行代码而非只有论文,符合社区「有代码的预印本胜过无代码的同行评审」的一贯偏好
  • 「新 SOTA 1B 模型」的说法被社区打问号,基准成绩尚未被独立复现,能否真正超越更大规模模型仍是开放问题
  • HRM 是否真的是超越 LLM 的实质一步,社区(如 r/learnmachinelearning)仍在争论、未有定论

可信度下载884次,点赞112;训练数据开源(data_io),许可证Apache-2.0

完整规格

规模
1B · 4096 · 权重格式未知,无法估算显存
授权
Apache-2.0 · 可商用
框架
transformers
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 26.3k → 27.4k · likes +12

观测时间线