模型 / LFM2.5-8B-A1B-APEX (LiquidAI / LocalAI)

LFM2.5-8B-A1B-APEX (LiquidAI / LocalAI)

8B参数1B激活MoE,消费级GPU可运行的APEX量化

作者 mudler

仓库标识mudler/LFM2.5-8B-A1B-APEX-GGUF

显存未知许可 需自查任务 文本生成最近核对 2026-08-05
运行内存
权重格式未知,无法估算显存
运行时
LLAMA-SERVER
下载
4,108

Hugging Face 源仓库 ↗

快速上手示例

llama-server -hf mudler/LFM2.5-8B-A1B-APEX-GGUF:LFM2.5-8B-A1B-APEX-I-Balanced.gguf

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
LiquidAI LFM2.5 的 APEX 量化版,提供多种 GGUF 文件,可直接用 LocalAI 或 llama.cpp 运行,适合低显存部署 MoE 模型。
对位
对位Llama-3.2-1B/3B密集模型,激活参数相近
适合
本地低成本对话 / 消费级GPU即时推理
不适合
高精度复杂推理任务

独立证据与社区反馈

5 个独立来源最近验证 2026-08-05

Liquid AI 迄今最认真的发布,在端侧工具调用/agentic 场景确实能打,但前代口碑不佳、代码审查质量存疑,社区态度谨慎乐观。

  • 端侧 agentic 工具调用性能突出,在 Tau²-Telecom 多轮工具使用基准上以 88.07 分大幅领先 26B 模型
  • 量化后可在消费级设备流畅运行(<6GB、M5 Max 253 tok/s、手机约 30 tok/s)
  • 128K 上下文窗口,支持长文档处理
  • 多语言支持有实测验证,非拉丁语系(印地语、泰语、越南语、印尼语、阿拉伯语)分词效率提升
  • Hugging Face 开放权重发布
  • 代码审查准确度差,经 Claude/ChatGPT 交叉评估后评价很低
  • Liquid 前代模型长期被 Gemma/Gwen 压着打,声誉透支
  • 官方明确声明不适用于所有工作负载
  • Hacker News 社区仍有「顺势疗法 AI」的嘲讽

可信度下载4.1k,11赞,基于llama.cpp,LocalAI团队出品

完整规格

规模
8B (激活1B) · 权重格式未知,无法估算显存
授权
LFM1.0 · 需自查
框架
localai / llama.cpp
血统
量化自 LFM2.5-8B-A1B
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 4k → 4.4k · likes +4

观测时间线

模型家族

查看全部家族 →