Qwythos-9B (Empero)
开源 9B 推理模型,不审查,支持 1M 上下文和函数调用
~5.6GB 4-bit许可 需自查任务 智能体最近核对 2026-07-08
仅 safetensors · 无 pickle 加载风险
- 格式
- 4-bit
- 文件
- ~4.9GB
- 运行内存
- ~5.6GB–7.3GB
- 运行时
- VLLM
- 下载
- 842
仅 safetensors · 无 pickle 加载风险
快速上手示例
vllm serve empero-ai/Qwythos-9B-Claude-Mythos-5-1M --max-model-len 1010000 依赖版本和硬件参数请以源仓库说明为准。
- 格式
- 4-bit
- 文件
- ~4.7GB
- 运行内存
- ~5.4GB–7GB
- 运行时
- OLLAMA
- 下载
- 688
快速上手示例
ollama run hf.co/empero-ai/Qwythos-9B-Claude-Mythos-5-1M-GGUF 依赖版本和硬件参数请以源仓库说明为准。
适合与不适合
独立证据与社区反馈
工具调用和补丁编辑在 Q8 量化下可用,但长上下文下容易陷入循环和错误操作
- Q8 量化下工具调用可用,补丁式代码编辑表现良好
- 1M 长上下文窗口,支持全代码库推理和多文档研究
- Apache 2.0 许可,9B 参数可运行在消费级硬件上
- 原生支持 OpenAI/Qwen3.5 风格函数调用,无需额外封装
- 上下文窗口增大后出现循环和错误操作,可能与采样参数设置有关
- 非通用聊天模型,是推理模型,需严格按模型卡指定采样参数使用
- 社区实测Empero-AI/Qwythos-9B-Claude-Mythos-5-1M | Hacker News
- 独立评测empero-ai/Qwythos-9B-Claude-Mythos-5-1M - Featherless AI
- 独立评测Qwythos-9B Review: Exploring the 1M Context Open-Source Reasoning Model — Deepsim Insights | by Dr. Shouke Wei | Jun, 2026 | Medium
- 独立评测How to Use Qwythos-9B: vLLM, SGLang, and Transformers Deployment Guide
可信度MMLU 提升 34.3 分,gsm8k 严格匹配提升 30 分,同 harness 同采样验证
完整规格
下载动量
30天下载 191.1k → 197.2k · likes +563
观测时间线
模型家族
- Qwen3.5-9B
- 量化 MaralGPT-Mythos-9B (MaralGPT)
- 量化 Qwen3.5-9B (Qwen)
- 量化 Qwen3.5-9B-MTP-GGUF (unsloth)
- 量化 Qwen3.5-9B-OptiQ-4bit (mlx-community)
- 微调 Qwythos-9B (Empero)