HRM-Text-1B (sapientinc)
1B预对齐前缀LM,用前缀条件做结构化输出与推理
~0.7GB 4-bit许可 可商用任务 文本生成最近核对 2026-07-22
适合与不适合
独立证据与社区反馈
社区对HRM-Text-1B采用自定义架构而非标准LLaMA/Qwen解码器感到好奇,极低训练成本(约$1k/40B tokens)和MATH基准表现引发讨论,但普遍持观望态度。
- 极低成本预训练:40B tokens约$1k,16张H100约46小时完成
- 非蒸馏/Llama系的全新1B规模架构,使用自定义hrm_text模型类
- 在MATH基准上超越Llama 3.2 3B
- 社区指出存在benchmark gaming的可能,即仅针对特定基准优化的风险
- 社区实测Sapient Intelligence releases HRM-Text 1B: 40B tokens
- 社区实测Instagram
- 社区实测HRM 1B : r/LocalLLaMA
- 官方/厂商GitHub - sapientinc/HRM-Text
可信度下载884次,点赞112;训练数据开源(data_io),许可证Apache-2.0
完整规格
下载动量
30天下载 29.8k → 22.8k · likes +12