
Nemotron-3-Embed-8B (NVIDIA)
作者 nvidia
~4.8GB 4-bit许可 需自查任务 向量嵌入最近核对 2026-07-19
- 格式
- 4-bit
- 文件
- ~4.2GB
- 运行内存
- ~4.8GB–6.2GB
- 运行时
- VLLM
- 下载
- 14,038
仅 safetensors · 无 pickle 加载风险
Hugging Face 源仓库 ↗
快速上手示例
vllm serve nvidia/Nemotron-3-Embed-8B-BF16 点击复制
依赖版本和硬件参数请以源仓库说明为准。
适合与不适合
- 入选理由
- 8B多语言embedding模型,支持32768长度,可用vLLM一键启在线服务,适合中文RAG场景,但需较大显存。
- 对位
- 对位 e5-mistral-7b 等开源嵌入模型
- 适合
- 多语言RAG检索增强生成 / 代码语义搜索与匹配
- 不适合
- 不适用于文本生成或对话
完整规格
- 规模
- 8B · 32768 · 下载 ~4.2GB · 显存最低 ~4.8GB · 推荐 ~6.2GB · 4-bit(估算)
- 授权
- OpenMDW-1.1 · 需自查
- 框架
- transformers / sentence-transformers / vllm
- 维度
- 4096 维 · 256k 序列
- 访问提示
- Hugging Face 可能需要代理