此页是 2026-09-05 的观测快照,查看该模型当前信息 → /m/jackrong__qwopus38-27b-flash-gguf/
归档 / 2026-09-05 / Qwopus3.8-27B-Flash-GGUF (Jackrong)
Qwopus3.8-27B-Flash-GGUF (Jackrong)
Qwen3.8-27B 微调 GGUF,面向本地 agent 工作流
- 入选理由
- 基于Qwen3.8-27B的GGUF微调版,提高MTP接受率、降低推理成本,适合本地长时agent任务,可直接llama.cpp跑。
- 对位
- 对位 Gemma-3-27B
- 适合
- 本地 MTP 投机解码 / 长程 agent 工具调用
- 不适合
- 追求最高单轮基准精度
- 规模
- 27B · 未知 · Q4 ~18GB / FP16 ~65GB
- 授权
- apache-2.0 · 需自查
- 框架
- llama.cpp / ollama
- 血统
- 量化自 Qwen3.8-27B
- 可信度
- HF 点赞 72;卡报 MMLU-Pro 91.28%、MTP 接受率 80.7%
快速上手示例
llama-server -hf Jackrong/Qwopus3.8-27B-Flash-GGUF 点击复制
依赖版本和硬件参数请以源仓库说明为准。
评分详情
- Q1
- 今天能接上用吗 5 / 5
- Q2
- 有可信证据吗 1 / 5
- Q3
- 是新东西吗 3 / 5
- 总分
- 9
HuggingFace 原始数据 (抓取于 2026-09-05)
- 作者
- Jackrong
- 推理库
- transformers
- 下载
- 0
- 点赞
- 72
- 许可证
- apache-2.0
- 标签
- transformers, gguf, llama.cpp, image-text-to-text, vision, multimodal, text-generation-inference, unsloth, conversational, text-generation, qwen3_8, qwen3, qwen, 27b, fine-tuned, instruction-tuned, reasoning, agent, agentic, tool-use, function-calling, code-generation, mtp, speculative-decoding, local-inference, safetensors, en, zh, es, ru, ja, base_model:Qwen/Qwen3.8-27B, base_model:quantized:Qwen/Qwen3.8-27B, license:apache-2.0, endpoints_compatible, region:us
探索
源链接