模型 / Nemotron-3-Embed-8B (NVIDIA)

Nemotron-3-Embed-8B (NVIDIA)

多语言文本嵌入模型,面向RAG检索与语义搜索。

作者 nvidia

~4.8GB 4-bit许可 需自查任务 向量嵌入最近核对 2026-07-19
格式
4-bit
文件
~4.2GB
运行内存
~4.8GB–6.2GB
运行时
VLLM
下载
14,038

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

快速上手示例

vllm serve nvidia/Nemotron-3-Embed-8B-BF16

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
8B多语言embedding模型,支持32768长度,可用vLLM一键启在线服务,适合中文RAG场景,但需较大显存。
对位
对位 e5-mistral-7b 等开源嵌入模型
适合
多语言RAG检索增强生成 / 代码语义搜索与匹配
不适合
不适用于文本生成或对话

完整规格

规模
8B · 32768 · 下载 ~4.2GB · 显存最低 ~4.8GB · 推荐 ~6.2GB · 4-bit(估算)
授权
OpenMDW-1.1 · 需自查
框架
transformers / sentence-transformers / vllm
维度
4096 维 · 256k 序列
访问提示
Hugging Face 可能需要代理

下载动量

观测时间线