1.7B 通用语言模型,支持 1M 上下文与工具调用
适合端侧 agent 与工具调用 / 代码生成与数学推理
短板需要 4B+ 模型能力的复杂推理
Q4 ~1.1GB / FP16 ~4.1GB · apache-2.0 · 1M · vllm需自查
证据1986 下载 / 84 赞
1.7B 通用语言模型,支持 1M 上下文与工具调用
适合端侧 agent 与工具调用 / 代码生成与数学推理
短板需要 4B+ 模型能力的复杂推理
Q4 ~1.1GB / FP16 ~4.1GB · apache-2.0 · 1M · vllm需自查
证据1986 下载 / 84 赞
社区版说话人分离,用于会议/访谈音频
适合会议录音说话人分段 / 播客/访谈多说话人标注
短板不适合直接做语音转写
未公开 · unknown · 未知 · pyannote.audio需自查
证据5072.7k 下载 / 1367 赞
Qwen3.8-27B 微调 GGUF,面向本地 agent 工作流
适合本地 MTP 投机解码 / 长程 agent 工具调用
短板追求最高单轮基准精度
Q4 ~18GB / FP16 ~65GB · apache-2.0 · 未知 · llama.cpp需自查
证据72 赞
腾讯 Hy4 量化版,需补丁构建 llama.cpp
适合8xH20 以上集群批处理推理 / 验证 2.38bpw 混合量化策略
短板单卡或未打补丁 llama.cpp
未公开 · 未知 · 未知 · llama.cpp需自查
证据109.2k 下载 / 91 赞
输入关键词,跨模型 / 数据集 / 空间 / 工具 / 资讯 / 论文 检索