Qwen3.6-35B-A3B-VQ (aquaman164)
MLX VQ量化35B MoE,适合Apple Silicon本地推理
~21GB 4-bit许可 可商用任务 文本生成最近核对 2026-07-19
适合与不适合
独立证据与社区反馈
社区普遍认为 Qwen3.6-35B-A3B 是当前性价比最高的开源本地编程模型之一,以 3B 活跃参数达到 73.4% SWE-bench 得分,可在消费级笔记本上流畅运行;但在实际使用中需要耐心调参,对 prompt 较敏感,长上下文提示处理延迟明显。
- 以 3B 活跃参数取得 73.4% SWE-bench Verified 得分,超过 Gemma 4 31B(52.0%)和 Gemma 4 26B A4B(52.0%)
- 35B 总参数、3B 活跃参数的 MoE 架构,计算成本相当于 3B 模型,可在消费级笔记本上本地运行
- SVG/图像生成质量在某些场景下优于 Claude Opus 4.7,如 pelican 骑自行车和 flamingo 骑独轮车的 SVG 生成
- 有社区发布的 Uncensored Aggressive 变体,0/465 次拒绝,声称无能力损失、无循环、无退化
- Apache 2.0 开源许可证,允许商用
- 在 VS Code + Copilot 集成中可正常完成复杂前端项目(Bike Shop Service Tracker),首次运行即功能完整
- 生成速度稳定在 94-105 t/s,适合消费级 GPU 本地推理
- 支持 262K 上下文窗口及多模态输入(文本+图像+视频)
- K_P 量化方案通过模型特定分析在相近体积下提升 1-2 个量化级别的质量
- 长上下文提示处理延迟突出,38K token 的 prompt 处理耗时 17.3 秒
- 对 prompt 格式异常敏感,会在与上下文冲突时强行将示例塞入回答
- 嵌套 JSON 输出不可靠,改用 XML 格式后表现正常
- 部分用户在 OpenCode 中遇到重复循环和空字符串函数调用问题,后自行归因于参数配置
- Q6_K 量化版本在编码规划和组织逻辑上被社区报告优于 Q8_0,大不一定更好
- BenchLM 综合评分仅 51.47/100,排名 #104/200
- 物理合理性图像生成弱于 Claude Opus 4.7(flamingo 骑独轮车测试中 Opus 更接近物理真实)
- 需要耐心调参,非开箱即用的完美体验
- 独立评测I Tested Alibaba Qwen3.6–35B-A3B vs Google Gemma 4 26B A4B — The Smaller-Active Model Won Coding by 21 Points
- 独立评测Qwen3.6-35B-A3B: 73.4% SWE-Bench, Runs Locally
- 独立评测Qwen3.6-35B-A3B: The Small Model That Codes Like a Giant
- 独立评测Qwen3.6-35B-A3B on my laptop drew me a better pelican than Claude Opus 4.7
- 社区实测Qwen3.6-35B-A3B on my laptop drew me a better pelican than Claude Opus 4.7 | Hacker News
- 社区实测Qwen3.6-35B-A3B Uncensored Aggressive is out with K_P quants!
- 社区实测Great results with Qwen3.6-35B-A3B-UD-Q5_K_XL + VS Code and Copilot
- 社区实测What do you use Qwen3.6 35b-a3b for locally?
- 社区实测Is qwen3.6 35b a3b good for coding at all?
- 社区实测Surprising discovery: Is Qwen3.6-35b-a3b (Q6_K) actually better at coding/planning than Q8?
- 独立评测Qwen3.6-35B-A3B Benchmarks, Pricing & Speed (July 2026)
- 基准/排行Qwen3.6-35B-A3B Benchmarks, Pricing & Size
- 社区实测Qwen3.6-35b-a3b seems like the best coding model rn
- 独立评测Qwen3.6 35B-A3B Full Test – Is THIS the Best LOCAL Model Yet?
- 转载/仓库unsloth/Qwen3.6-35B-A3B-GGUF
可信度首个Apple Silicon上trained-codebook VQ模型,11.53GB,实测66 tok/s
完整规格
下载动量
30天下载 976 → 1.2k
观测时间线
模型家族
- Qwen3.6-35B-A3B
- 量化 Qwen3.6-35B-A3B (andreaborio)
- 量化 Qwen3.6-35B-A3B (Qwen)
- 量化 Qwen3.6-35B-A3B-GGUF (Unsloth)
- 量化 Qwen3.6-35B-A3B-NVFP4 (NVIDIA)
- 量化 Qwen3.6-35B-A3B-OptiQ-4bit (mlx-community)
- 量化 Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive
- 量化 Qwen3.6-35B-A3B-VQ (aquaman164)