模型 / Qwen3.8-9B (Empero)

Qwen3.8-9B (Empero)

9B 蒸馏推理模型,面向数学/代码/工具调用

作者 empero-ai

仓库标识empero-ai/Qwen3.8-9B

显存未知许可 可商用任务 智能体最近核对 2026-08-18
运行内存
权重格式未知,无法估算显存
运行时
VLLM
下载
540

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

快速上手示例

vllm serve empero-ai/Qwen3.8-9B

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
有清晰transformers示例,但依赖flash-linear-attention等内核,需自行配置。基于Qwen3.5-9B全参数蒸馏,MMLU大幅提升,支持函数调用与262K上下文,适合单卡部署的推理场景。
对位
对位 Qwen3.5-9B / Llama-3-8B
适合
数学与代码推理问答 / 函数调用与长上下文任务
不适合
视觉或多模态任务(未评估)

完整规格

规模
9B · 262k · 权重格式未知,无法估算显存
授权
Apache-2.0 · 可商用
框架
transformers / vllm / sglang
工具调用
Qwen3.5 规范 function calling
血统
微调自 Qwen3.5-9B
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 26.7k → 27.6k · likes +68

观测时间线

模型家族

查看全部家族 →