模型 / Qwen3.6-35B-A3B (andreaborio)

Qwen3.6-35B-A3B (andreaborio)

Qwen3.6 MoE 量化版,Apple Metal 加速推理

作者 andreaborio

~21GB 4-bit许可 可商用任务 文本生成最近核对 2026-07-18
格式
4-bit
文件
~18GB
运行内存
~21GB–27GB
运行时
OLLAMA
下载
102

Hugging Face 源仓库 ↗

快速上手示例

ollama run hf.co/andreaborio/Qwen3.6-35B-A3B-DS4-ExpertMajor-v1-GGUF

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
Qwen3.6-35B-A3B的GGUF量化版,含标准格式可直接用llama.cpp,苹果用户可试用作者优化版。仅量化重打包,无新能力。
对位
对位 Qwen2.5-3B (3B 激活)
适合
Apple Silicon 本地聊天 / 低内存 MoE 研究
不适合
非 Apple Metal 平台

完整规格

规模
35B (3B 激活) · 下载 ~18GB · 显存最低 ~21GB · 推荐 ~27GB · 4-bit(估算)
授权
apache-2.0 · 可商用
框架
llama.cpp / ollama / MLX / DS4
血统
量化自 Qwen3.6-35B-A3B
访问提示
Hugging Face 可能需要代理

下载动量

观测时间线

模型家族

查看全部家族 →