模型 / Ornith-1.0-35B-MLX (deepreinforce-ai)

Ornith-1.0-35B-MLX (deepreinforce-ai)

Apple Silicon 上 Claude-Code 式本地编码代理

作者 nathansutton

仓库标识nathansutton/Ornith-1.0-35B-UD-Q2_K_XL-MLX

~12GB 2-bit许可 需自查任务 文本生成最近核对 2026-08-05
格式
2-bit
文件
~10GB
运行内存
~12GB–15GB
运行时
mlx
下载
818

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

适合与不适合

入选理由
针对Apple Silicon的2-bit动态量化,可在24GB以上Mac本地运行,适合编码agent场景。门槛:需≥24GB Mac。
对位
对位 7B 级本地编码模型 (活跃 ~3B)
适合
苹果芯片本地编码代理 / 低资源Mac代码生成/对话
不适合
16/18 GB 内存 Mac 不可用

独立证据与社区反馈

3 个独立来源最近验证 2026-08-05

社区普遍认为 Ornith-1.0-35B 推理速度极快,适合从零起建项目,但改已有代码容易改出问题

  • 推理速度远超同尺寸模型,实测比 Qwen 3.6 35B 快约 3 倍
  • 本地部署极其简单,无需升级 llama.cpp 或额外服务栈,下载 GGUF 即可运行
  • 从零起建(greenfield)项目的代码质量较好,实现方案靠谱
  • 工具调用稳定可靠
  • 不擅长精确理解和修改已有代码,容易偏离预期改动
  • 在代码移植/对齐场景下可能出现幻觉式修改,把正确的代码改坏
  • 部分用户反馈其调试能力(找 bug)表现一般,虽然基准评测分数高

可信度35B MoE 256专家/top-8, ~3B活跃, 13.4GB权重, M4 Pro 24GB上67 tok/s解码

完整规格

规模
35B (3B 活跃) · 下载 ~10GB · 显存最低 ~12GB · 推荐 ~15GB · 2-bit(估算)
商用
需自查
框架
mlx
血统
量化自 Ornith-1.0-35B
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 117 → 91

观测时间线

模型家族

查看全部家族 →