模型 / Hy3-GGUF (腾讯)

Hy3-GGUF (腾讯)

腾讯 Hy3 混合精度 GGUF,针对本地受限硬件极限压缩

作者 AngelSlim

仓库标识AngelSlim/Hy3-GGUF

显存未知许可 可商用任务 文本生成最近核对 2026-08-05
运行内存
缺少可用的参数量依据,无法估算显存
运行时
OLLAMA

Hugging Face 源仓库 ↗

快速上手示例

ollama run hf.co/AngelSlim/Hy3-GGUF

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
腾讯Hy3的GGUF量化版,提供完整部署脚本和混合精度配方,支持MTP自推测解码,适合多卡服务器本地运行。
适合
H20 单卡/双卡本地推理 / 带自推测解码的低延迟生成
不适合
生产环境高并发在线服务

独立证据与社区反馈

3 个独立来源最近验证 2026-08-05

非前沿级智能,但作为日常开发工具足够可靠,是同参数规模下性价比突出的务实之选

  • 在同等参数规模下,以远低于更大模型的计算成本,达到与 DeepSeek-V3.2、Kimi-K2.5 等大模型可比的智能体基准表现
  • 编码能力代际提升显著:SWE-bench Verified 从 53.0% 跃升至 74.4%,终端自主任务执行从 23.2% 提升至 54.4%
  • 能可靠地导航代码库并执行开发者指令,适合作为日常开发工作马
  • 非前沿级智能,整体生成质量与更大的旗舰模型存在差距,落后于 GLM-5.2 等当前开源 SOTA
  • 复杂任务中存在用近似代替精确物理计算的情况,偶有边缘情况 bug

可信度腾讯 AngelSlim 团队提供,附 llama.cpp 补丁与量化配方

完整规格

规模
65536 · 缺少可用的参数量依据,无法估算显存
授权
apache-2.0 · 可商用
框架
llama.cpp / ollama
血统
量化自 Hy3
访问提示
标记为魔搭可用,具体仓库请自行核对

下载动量

30天下载 350.7k → 354.6k · likes +3

观测时间线