模型 / Nemotron-3-Embed-1B (NVIDIA)

Nemotron-3-Embed-1B (NVIDIA)

多语言文本嵌入模型,用于语义搜索与 RAG

作者 nvidia

~0.7GB 4-bit许可 需自查任务 向量嵌入最近核对 2026-07-18
格式
4-bit
文件
~0.6GB
运行内存
~0.7GB–0.9GB
运行时
VLLM
下载
46,305

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

快速上手示例

vllm serve nvidia/Nemotron-3-Embed-1B-BF16

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
NVIDIA最新1B嵌入模型,支持34种语言和32K上下文,通过vLLM可快速部署为OpenAI兼容API,适合多语言RAG检索。
对位
对位 BGE-M3 / multilingual-e5-large
适合
多语言语义搜索 / RAG 系统的检索组件
不适合
不适用于文本生成

完整规格

规模
1.14B · 32768 · 下载 ~0.6GB · 显存最低 ~0.7GB · 推荐 ~0.9GB · 4-bit(估算)
授权
OpenMDW-1.1 · 需自查
框架
transformers / sentence-transformers / vllm
维度
2048 维 · 256k 序列
血统
微调自 Ministral-3-3B-Instruct-2512
访问提示
Hugging Face 可能需要代理

下载动量

观测时间线

模型家族

查看全部家族 →