模型 / niko_orchestrator_gguf (SAi404)

niko_orchestrator_gguf (SAi404)

Llama-3.2-3B 微调,GGUF 格式,给本地推理用户

作者 SAi404

~1.8GB 4-bit许可 需自查最近核对 2026-07-22
格式
4-bit
文件
~1.6GB
运行内存
~1.8GB–2.3GB
运行时
LLAMA-CLI
下载
115

Hugging Face 源仓库 ↗

快速上手示例

llama-cli -hf SAi404/niko_orchestrator_gguf --jinja

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
基于 Llama-3.2-3B 微调的 GGUF 模型,可直接用 llama.cpp 或 Ollama 运行,适合本地对话推理。
对位
对位 Llama-3.2-3B-Instruct
适合
资源受限的本地推理 / 轻量级对话与编排任务
不适合
高精度复杂推理

独立证据与社区反馈

3 个独立来源最近验证 2026-07-22

Hacker News 以高质量技术内容见长,但对非技术用户和新手来说过于小众且难以导航。

  • 提供聚焦技术领域的深度讨论和新闻聚合
  • 界面简陋,新手难以入门和过滤感兴趣的内容
  • 内容过于小众,仅聚焦技术领域
  • 不适合追踪通用/非技术类新闻

可信度下载 115 次,基于 Llama-3.2-3B-Instruct 微调,Unsloth 量化 Q4_K_M。

完整规格

规模
3B · 下载 ~1.6GB · 显存最低 ~1.8GB · 推荐 ~2.3GB · 4-bit(估算)
商用
需自查
框架
llama.cpp / ollama
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 61 → 45

观测时间线