Qwen3.6-35B-A3B-VQ (aquaman164)
MLX VQ量化35B MoE,适合Apple Silicon本地推理
仓库标识aquaman164/Qwen3.6-35B-A3B-MLX-VQ-2.6bpw
显存未知许可 可商用任务 文本生成最近核对 2026-08-05
链接指向的配置 不在本页收录的形态里,已显示默认形态(原生)。
适合与不适合
独立证据与社区反馈
社区普遍认为这是一款当前最强的本地编程模型之一,SWE-bench 73.4% 在同等激活参数量级碾压 Gemma 4,但 chat_template 配置极为敏感,配置错误则 reasoning/tool calling 全面翻车;量化版在困难任务上质量损失明显,且部分用户在 HumanEval 上测得不及上代 Qwen3.5。性价比极高、部署门槛低,进取代正确的配置后是日常编码工作的可靠选择。
- agentic coding 能力突出,SWE-bench Verified 73.4%,远超 Gemma 4-31B 的 52.0%
- MCP 工具调用/函数集成能力是 Gemma 4 的两倍以上,MCPMark 37.0% vs 18.1%
- 部署门槛极低,16GB Mac Mini 即可运行,quantized 后 24GB VRAM 内可装 IQ4XS + Q8 KV cache 加 262K 上下文
- 多模态能力实用,OmniDocBench 89.9%、VideoMMMU 83.7%,下载 unsloth 的 mmproj 文件即可启用 vision
- 完全免费开源,模型权重可直接下载,无任何使用成本
- 日常工作任务可落地,社区用户反馈「get real work done」「no better smaller model」
- 配置正确(默认 chat_template)时表现顶级,在 opencode 和 pi coding agent 等 harness 中击败 Gemma 4 26B A4B
- 量化版在困难任务上质量退化严重,Q4_K_M 级别会暴露明显局限,不适合生产环境
- chat_template 配置极为敏感,沿用 Qwen3.5 的模板会出现 timeout、thinking 失效等大量错误,须用默认配置
- 部分自测显示 HumanEval / HumanEval+ 得分不及 Qwen3.5,Gemma 4 31B 和 26B-A4B 在该基准上反而更高
- 低量化版本(q5)在 opencode 中会无限重复输出,基本不可用
- 量化版 kv cache 在某些配置下性能极差,即使全部可放入 VRAM 也会强制走 CPU 处理
- 视觉 benchmark 对比数据为厂商自报,第三方独立评测尚未复现,RealWorldQA 差距可疑
- 上下文增长后推理速度明显变慢
- 偶有循环输出,需手动停止并重新提示才能继续
- 社区实测Qwen3.6-35B-A3B on my laptop drew me a better pelican ...
- 社区实测The Qwen 3.6 35B A3B hype is real!!! : r/LocalLLaMA
- 社区实测Qwen3.6 35B A3B Heretic (KLD 0.0015!) Incredible model. ...
- 独立评测Qwen3.6-35B-A3B on my laptop drew me a better pelican ...
- 社区实测Is qwen3.6 35b a3b good for coding at all? : r/LocalLLaMA
- 独立评测Qwen3.6-35B-A3B: 73.4% SWE-Bench, Runs Locally
- 独立评测Qwen3.6-35B-A3B: The Small Model That Codes Like a Giant
- 独立评测I Tested Alibaba Qwen3.6-35B-A3B vs Google Gemma 4 ...
- 独立评测Qwen3.6-35B-A3B vs Gemma4-26B: Quantized Local Showdown on ...
- 独立评测Qwen3.6 35B A3B is THE ONE! The Local LLM Champ on ...
- 转载/仓库unsloth/Qwen3.6-35B-A3B-GGUF
可信度首个Apple Silicon上trained-codebook VQ模型,11.53GB,实测66 tok/s
完整规格
下载动量
30天下载 126 → 90
观测时间线
模型家族
- Qwen3.6-35B-A3B
- 微调 Macaron-V1-Tall (MindLab)
- 量化 Qwen3.6-35B-A3B (AutomatosX)
- 量化 Qwen3.6-35B-A3B (Qwen)
- 量化 Qwen3.6-35B-A3B (andreaborio)
- 量化 Qwen3.6-35B-A3B-Escha-W2 (EschaLabs)
- 量化 Qwen3.6-35B-A3B-GGUF (Unsloth)
- 量化 Qwen3.6-35B-A3B-NVFP4 (NVIDIA)
- 量化 Qwen3.6-35B-A3B-OptiQ-4bit (mlx-community)
- 量化 Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive
- 量化 Qwen3.6-35B-A3B-VQ (aquaman164)
- 量化 Qwen3.6-35B-A3B-VQ-3.4bpw (TheDrainFlorist)
- 量化 Qwen3.6-35B-A3B-VQ-3.8bpw (TheDrainFlorist)
- 量化 Qwen3.6-35B-A3B-VQ-4.6bpw (TheDrainFlorist)
- 量化 Qwen3.6-35B-A3B-VQ-5.4bpw (TheDrainFlorist)
- 微调 XYZ-Aquila-mini (XYZAILab)