模型 / LFM2.5-8B-A1B (LiquidAI)

LFM2.5-8B-A1B (LiquidAI)

8.3B总参/1.5B活跃,面向端侧个人助手的混合架构模型

作者 LiquidAI

~5.1GB 4-bit许可 需自查任务 文本生成最近核对 2026-07-22

仅 safetensors · 无 pickle 加载风险

格式
4-bit
文件
~4.4GB
运行内存
~5.1GB–6.6GB
运行时
llama.cpp

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

适合与不适合

入选理由
LFM2.5 基础模型性能强且支持工具调用,但本模型仅为量化版本,无新能力。
对位
对位 Granite-4.0-H-Tiny (7B/A1B) 与 Qwen3.5-4B
适合
端侧个人助理及工具调用 / 多语言指令跟随与结构化输出
不适合
重度编程及无检索知识问答

独立证据与社区反馈

4 个独立来源最近验证 2026-07-22

一款注重本地推理速度的 MoE agent 模型,工具调用可用,但编程能力明显偏弱

  • 本地设备高效推理:RTX 4060 笔记本实测约 76 tok/s,官方数据 M5 Max 约 253 tok/s,占用不到 6 GB
  • 原生支持工具调用/函数调用,可在 Ollama 内完成完整 agent loop
  • 128K 上下文窗口,支持长文本处理
  • 多语言输出(日语、法语、阿拉伯语)可用
  • 支持 JSON 结构化输出
  • 编程能力较弱,6 项 coding 测试中 4 项失败
  • 混合架构(18 conv + 6 attention)与主流 transformer 生态的兼容性需自行验证
  • 通用对话/知识问答能力未经充分社区验证,主要定位为 agent/工具调用场景

可信度下载量29k,Unsloth Dynamic 2.0量化,原模型IFEval 91.84,AA-Omniscience指数-24.70

完整规格

规模
8.3B (1.5B active) · 128k · 下载 ~4.4GB · 显存最低 ~5.1GB · 推荐 ~6.6GB · 4-bit(估算)
授权
LFM1.0 · 需自查
框架
llama.cpp / LM Studio / ollama
血统
量化自 LFM2.5-8B-A1B
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 64.1k → 57.8k · likes +25

观测时间线

模型家族

查看全部家族 →