模型 / jina-embeddings-v5-omni-small (Jina)

jina-embeddings-v5-omni-small (Jina)

多模态嵌入模型,支持文本/图像/视频/音频

作者 jinaai

~1GB 4-bit许可 不可商用任务 向量嵌入最近核对 2026-06-21
格式
4-bit
文件
~0.8GB
运行内存
~1GB–1.3GB
运行时
VLLM
下载
28,917

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

快速上手示例

vllm serve jinaai/jina-embeddings-v5-omni-small --trust-remote-code --hf-overrides '{"task":"retrieval"}'

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
transformers可用,有详尽示例;下载量2.8万,有arXiv论文;新增多模态embedding能力,与text共享空间。
对位
对位 OpenAI CLIP / Cohere Embed multimodal
适合
多模态检索与RAG / 跨模态零样本分类与聚类
不适合
仅需文本嵌入的轻量场景

独立证据与社区反馈

3 个独立来源 · 另 1 官方/转载最近验证 2026-06-21

在同等体量下是少有的同时覆盖文本、图像、视频、音频四模态的开源嵌入模型,且文本向量与 v5-text 完全对齐,迁移成本低。

  • 文本向量与 jina-embeddings-v5-text 完全一致,已有文本索引无需重建即可扩展为多模态检索
  • 单一模型覆盖文本、图像、视频、音频四种模态的嵌入,无需为不同模态维护多个模型
  • 支持近 100 种语言的多语言嵌入
  • 使用 transformers 加载需设置 trust_remote_code=True,存在安全风险
  • small 版本参数量 1.57B,对边缘设备或资源受限环境部署仍有压力

可信度下载量 28917,vLLM 0.20.1 已验证,Matryoshka 32-1024 维

完整规格

规模
1.74B · 32768 · 下载 ~0.8GB · 显存最低 ~1GB · 推荐 ~1.3GB · 4-bit(估算)
授权
cc-by-nc-4.0 · 不可商用
框架
transformers / sentence-transformers / vllm
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 88.1k → 82.7k · likes +16

观测时间线