模型 / LFM2.5-Embedding-350M (LiquidAI)

LFM2.5-Embedding-350M (LiquidAI)

11语种双编码器,面向端侧语义检索

作者 LiquidAI

~0.2GB 4-bit许可 需自查任务 向量嵌入最近核对 2026-06-19
格式
4-bit
文件
~0.2GB
运行内存
~0.2GB–0.3GB
运行时
sentence-transformers
下载
3,734

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

适合与不适合

入选理由
多语言检索新SOTA,支持11种语言,可用sentence-transformers或GGUF快速部署,适合RAG和语义搜索。
对位
对位 Qwen3-Embedding-0.6B
适合
端侧本地语义搜索 (文件/邮件) / 跨语言 FAQ/知识库检索
不适合
长文档 (>512 tokens) 检索

独立证据与社区反馈

3 个独立来源最近验证 2026-06-19

社区对 LFM2.5-Embedding-350M 以 350M 小参数量实现超低延迟多语言检索表示兴奋

  • 端到端检索延迟低至 1.5ms(企业栈),CPU 上通过 llama.cpp 也可做到 <10ms
  • 覆盖 11 种语言的多语言与跨语言检索
  • 350M 小体积可运行在笔记本、边缘设备上

可信度下载3734,多语言NanoBEIR NDCG@10 0.577,MKQA Recall@20 0.691,同级最佳,已出GGUF

完整规格

规模
350M · 32k · 下载 ~0.2GB · 显存最低 ~0.2GB · 推荐 ~0.3GB · 4-bit(估算)
授权
lfm1.0 · 需自查
框架
sentence-transformers / llama.cpp
维度
1024 维 · 125k 序列
血统
微调自 LFM2.5-350M-Base
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 37.3k → 33.1k · likes +22

观测时间线

模型家族

查看全部家族 →