模型 / Huihui-Qwythos-9B-1M (huihui-ai)

Huihui-Qwythos-9B-1M (huihui-ai)

未审查 1M 上下文 Qwen3.5 微调,支持工具调用

作者 huihui-ai

仓库标识huihui-ai/Huihui-Qwythos-9B-Claude-Mythos-5-1M-abliterated-GGUF

显存未知许可 可商用任务 智能体最近核对 2026-08-05
运行内存
权重格式未知,无法估算显存
运行时
LLAMA-CLI
下载
37,885

Hugging Face 源仓库 ↗

快速上手示例

llama-cli -hf huihui-ai/Huihui-Qwythos-9B-Claude-Mythos-5-1M-abliterated-GGUF --model Huihui-Qwythos-9B-Claude-Mythos-5-1M-abliterated-Q4_K.gguf -ngl 99 -c 262144 -fa on -np 1 --spec-type draft-mtp --spec-draft-n-max 2

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
GGUF格式可直接用llama.cpp运行,5分钟内可跑;基于Qwythos-9B去审查,适合需要无限制输出的研究和实验场景。
对位
对位 Qwen2.5-7B-Instruct
适合
长上下文角色扮演创作 / 工具调用与代理任务
不适合
需内容审查的生产场景

独立证据与社区反馈

2 个独立来源最近验证 2026-08-05

一款轻量、可本地运行且具备工具调用能力的开源推理模型,社区普遍认为它在 9B 量级里表现不错,但 1M 上下文窗口在实际使用中很难兑现。

  • 体积仅 5.6 GB,可在消费级硬件上离线运行,满足免费、私密的本地推理需求
  • 具备原生工具/函数调用能力,能生成可运行的应用代码(如时钟、贪吃蛇、落地页等)
  • 按社区实测可接入 Ollama 等 agent 框架,适合作为本地 agent 的推理后端
  • 1M 上下文窗口在实际个人配置中无法达到,实际可用窗口受 RAM 和 Ollama 设置限制
  • 9B 参数规模决定了它不是前沿模型,推理能力有上限
  • 加载速度可能偏慢
  • 没有内置记忆等附加功能,仅是一个纯推理模型

可信度下载量 37.9k, 点赞 55, 基于 Qwen3.5, 支持 1M 上下文与 MTP 推测解码

完整规格

规模
9B · 1M · 权重格式未知,无法估算显存
授权
apache-2.0 · 可商用
框架
llama.cpp
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 43.7k → 41.5k · likes +21

观测时间线