模型 / Qwythos-9B (Empero)

Qwythos-9B (Empero)

开源 9B 推理模型,不审查,支持 1M 上下文和函数调用

作者 empero-ai

~5.6GB 4-bit许可 需自查任务 智能体最近核对 2026-07-08

仅 safetensors · 无 pickle 加载风险

格式
4-bit
文件
~4.9GB
运行内存
~5.6GB–7.3GB
运行时
VLLM
下载
842

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

快速上手示例

vllm serve empero-ai/Qwythos-9B-Claude-Mythos-5-1M --max-model-len 1010000

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
Qwen3.5-9B全参数微调,推理能力显著提升,支持1M上下文和函数调用,适合长文本与工具代理场景,需自行安装额外内核依赖。
对位
对位 Qwen3.5-9B
适合
长上下文推理与工具调用 / 网络安全 / 生物医学等敏感技术问答
不适合
需要安全审查的生产部署

独立证据与社区反馈

4 个独立来源最近验证 2026-07-08

工具调用和补丁编辑在 Q8 量化下可用,但长上下文下容易陷入循环和错误操作

  • Q8 量化下工具调用可用,补丁式代码编辑表现良好
  • 1M 长上下文窗口,支持全代码库推理和多文档研究
  • Apache 2.0 许可,9B 参数可运行在消费级硬件上
  • 原生支持 OpenAI/Qwen3.5 风格函数调用,无需额外封装
  • 上下文窗口增大后出现循环和错误操作,可能与采样参数设置有关
  • 非通用聊天模型,是推理模型,需严格按模型卡指定采样参数使用

可信度MMLU 提升 34.3 分,gsm8k 严格匹配提升 30 分,同 harness 同采样验证

完整规格

规模
9B · 1M · 下载 ~4.9GB · 显存最低 ~5.6GB · 推荐 ~7.3GB · 4-bit(估算)
授权
Apache 2.0 · 需自查
框架
vllm / transformers
工具调用
Qwen3.5 原生函数调用(OpenAI 兼容格式)
血统
微调自 Qwen3.5-9B
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 191.1k → 197.2k · likes +563

观测时间线

模型家族

查看全部家族 →