模型 / ZwZ-7B (inclusionAI)

ZwZ-7B (inclusionAI)

7B 视觉语言模型 GGUF 量化包,适合本地 VQA 与对话

作者 mradermacher

~4.2GB 4-bit许可 可商用最近核对 2026-07-22
格式
4-bit
文件
~3.7GB
运行内存
~4.2GB–5.5GB
运行时
llama.cpp
下载
201

Hugging Face 源仓库 ↗

适合与不适合

入选理由
提供ZwZ-7B的多档量化GGUF,可用llama.cpp快速部署,适合需要低资源运行该模型的用户。
对位
对位 LLaVA-1.5-7B 等开源 VLM
适合
视觉问答(VQA)实验 / 本地多模态对话原型开发
不适合
高精度视觉理解或生产部署

独立证据与社区反馈

2 个来源 · 均为官方/厂商 · 暂无独立验证最近验证 2026-07-22

厂商材料,未经独立验证:一个专注于细粒度多模态感知的 Qwen2.5-VL-7B 微调版,在细粒度感知基准上领先同类开源模型,但通用视觉理解建议回退至基座模型。

  • 无需推理时缩放或工具调用,单次前向即可完成细粒度视觉感知
  • 基于 R2I 蒸馏与强化学习,在细粒度感知基准上达到同类 Qwen2.5-VL-7B 开源模型中的领先水平
  • 性能针对细粒度感知优化,通用多模态理解场景下基座模型 Qwen2.5-VL-7B 可能更合适
  • 综合基准平均分低于同系列更小的 ZwZ-4B(66.86 vs 62.42),参数量与收益不匹配

可信度量化作者 mradermacher 提供 imatrix 增强量化,并给出 22 种规格、质量对比图

完整规格

规模
7B · 下载 ~3.7GB · 显存最低 ~4.2GB · 推荐 ~5.5GB · 4-bit(估算)
授权
Apache 2.0 · 可商用
框架
llama.cpp / ollama
血统
量化自 ZwZ-7B
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 228 → 196

观测时间线