模型 / Qwen3.5-35B-A3B (Qwen)

Qwen3.5-35B-A3B (Qwen)

4-bit MLX 量化,Apple Silicon 本地运行文本生成

作者 mlx-community

仓库标识mlx-community/Qwen3.5-35B-A3B-OptiQ-4bit

显存未知许可 可商用任务 文本生成最近核对 2026-07-15
运行内存
格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
运行时
MLX_LM
下载
720

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

快速上手示例

mlx_lm.generate --model mlx-community/Qwen3.5-35B-A3B-OptiQ-4bit --prompt 'Explain quantum computing.' --max-tokens 200

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
为Apple Silicon优化的混合精度量化版Qwen3.5-35B-A3B,5分钟即可本地运行,基准略优于均匀4bit。适合Mac用户快速部署。
对位
对位 Qwen2.5-3B
适合
Apple Silicon 本地大模型推理 / 敏感层 8-bit 保精度的代码/指令任务
不适合
显存<16GB 设备运行受限

完整规格

规模
35B (3B 激活) · 128k · 格式线索互相矛盾(含估算映射未支持的位宽),无法估算显存
授权
apache-2.0 · 可商用
框架
mlx
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 434 → 439 · likes +1

观测时间线