模型 / LFM2.5-1.2B-JP (LiquidAI)

LFM2.5-1.2B-JP (LiquidAI)

日英双语聊天模型,适合代理工作流与工具使用

作者 LiquidAI

~0.7GB 4-bit许可 需自查任务 文本生成最近核对 2026-06-19
格式
4-bit
文件
~0.6GB
运行内存
~0.7GB–0.9GB
运行时
LLAMA-SERVER
下载
3,856

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

快速上手示例

llama-server -hf LiquidAI/LFM2.5-1.2B-JP-202606-GGUF

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
1.2B日语聊天模型,性能领先同尺寸,支持工具调用和结构化输出,提供Transformers/vLLM/GGUF等多框架和Colab示例,适合边缘部署与日语应用。
对位
对位 Qwen3-1.7B、Llama-3.2-1B 日语模型
适合
代理工作流与工具调用 / 日英双语结构化输出
不适合
知识密集型问答

独立证据与社区反馈

3 个独立来源 · 另 1 官方/转载最近验证 2026-06-19

轻量高速的日语优化模型,适合边缘设备本地部署,但知识密集型任务和编程场景表现有限

  • 日语对话场景专项优化,适合日语聊天需求
  • 手机/边缘设备本地运行,高吞吐(~280-310 TPS)与低延迟(<15ms TTFT)
  • 支持 Ollama、vLLM、SGLang、Docker 等多种部署方式
  • 知识密集型任务和编程场景表现不佳
  • 官方建议针对具体场景微调以获得最佳效果

可信度3856下载,JMMLU-ProX 36.2,JFBench 54.8,指令遵循79.1,数学62.5,超越Qwen3-1.7B等同规模模型

完整规格

规模
1.2B · 32k · 下载 ~0.6GB · 显存最低 ~0.7GB · 推荐 ~0.9GB · 4-bit(估算)
授权
LFM1.0 · 需自查
框架
transformers / vllm / llama.cpp / mlx / onnx
血统
微调自 LFM2.5-1.2B-Base
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 18.9k → 20.5k · likes +3

观测时间线