模型 / LFM2.5-230M (LiquidAI)

LFM2.5-230M (LiquidAI)

混合架构边缘设备模型,用于设备端文本生成

作者 LiquidAI

~0.1GB 4-bit许可 需自查任务 文本生成最近核对 2026-07-05

仅 safetensors · 无 pickle 加载风险

格式
4-bit
文件
~0.1GB
运行内存
~0.1GB–0.2GB
运行时
LLAMA-SERVER
下载
7,334

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

快速上手示例

llama-server -hf LiquidAI/LFM2.5-230M-GGUF

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
LFM2.5是轻量混合文本模型,GGUF格式可直接用llama.cpp运行,适合边缘设备部署和快速试用。
对位
对位 SmolLM2-135M/360M
适合
设备端文本生成与补全 / 低功耗场景下的轻量对话
不适合
复杂推理或长上下文生成

独立证据与社区反馈

3 个独立来源最近验证 2026-07-05

230M 级别模型中实测表现超出预期,尤其在数据提取和经微调后的编码场景中性价比高,但作为基础模型当前原生能力仍偏简单

  • 端侧/低算力设备上的可运行性(手机、树莓派等)
  • 以小博大的数据提取能力,官方基准上优于 4 倍参数量的模型
  • 低成本硬件上实现可用推理速度(Raspberry Pi 5 达 42 tok/s, Galaxy S25 Ultra 达 213 tok/s)
  • 当前原生行为/能力尚简单,需自行微调才能适配具体生产任务
  • 通用对话与复杂推理能力有限,不适合直接作为日常聊天模型使用

可信度累计 8505 次下载,48 点赞,GGUF 格式可直接用 llama.cpp 推理

完整规格

规模
230M · 32768 · 下载 ~0.1GB · 显存最低 ~0.1GB · 推荐 ~0.2GB · 4-bit(估算)
授权
LFM1.0 · 需自查
框架
llama.cpp
工具调用
自定义模板 (<|tool_call_start|>/<|tool_call_end|> 包裹Python调用)
血统
量化自 LFM2.5-230M
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 56.5k → 61.7k

观测时间线