模型 / GPT-OSS-20B (OpenAI)

GPT-OSS-20B (OpenAI)

2-bit 量化 MLX 模型,专为 Apple Silicon 推理

作者 majentik

~7.1GB 2-bit许可 需自查任务 文本生成最近核对 2026-07-21
格式
2-bit
文件
~6.2GB
运行内存
~7.1GB–9.2GB
运行时
MLX_LM
下载
283

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

快速上手示例

mlx_lm.generate --model majentik/gpt-oss-20b-TurboQuant-MLX-2bit --prompt '你的提示'

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
苹果M芯片用户可用mlx-lm快速跑2bit量化版GPT-OSS-20B,约6GB显存,质量有损但适合低内存设备。无第三方验证,仅量化重打包。
适合
Apple Silicon 设备本地推理 / 极低内存占用(约 6 GB)
不适合
高精度文本生成

完整规格

规模
20B (MoE) · 下载 ~6.2GB · 显存最低 ~7.1GB · 推荐 ~9.2GB · 2-bit(估算)
授权
Apache 2.0 · 需自查
框架
mlx
血统
量化自 gpt-oss-20b
访问提示
Hugging Face 可能需要代理

下载动量

观测时间线

模型家族

查看全部家族 →