模型 / jina-embeddings-v5-omni-small (Jina)

jina-embeddings-v5-omni-small (Jina)

多模态嵌入模型,支持文本/图像/视频/音频

作者 jinaai

仓库标识jinaai/jina-embeddings-v5-omni-small

显存未知许可 不可商用任务 向量嵌入最近核对 2026-08-09
运行内存
权重格式未知,无法估算显存
运行时
VLLM
下载
28,917

仅 safetensors · 无 pickle 加载风险

Hugging Face 源仓库 ↗

快速上手示例

vllm serve jinaai/jina-embeddings-v5-omni-small --trust-remote-code --hf-overrides '{"task":"retrieval"}'

依赖版本和硬件参数请以源仓库说明为准。

适合与不适合

入选理由
transformers可用,有详尽示例;下载量2.8万,有arXiv论文;新增多模态embedding能力,与text共享空间。
对位
对位 OpenAI CLIP / Cohere Embed multimodal
适合
多模态检索与RAG / 跨模态零样本分类与聚类
不适合
仅需文本嵌入的轻量场景

独立证据与社区反馈

1 个独立来源 · 另 2 官方/转载最近验证 2026-08-09

独立来源不足,尚未形成社区共识:开源多模态嵌入模型的前沿选择,在图像、视频、音频基准测试中定义开源权重前沿

  • 多模态(文本、图像、视频、音频)统一向量空间嵌入
  • 与纯文本版 jina-embeddings-v5-text-small 向量空间对齐,便于混合检索
  • 提供 GGUF 格式,支持 llama.cpp 本地部署

可信度下载量 28917,vLLM 0.20.1 已验证,Matryoshka 32-1024 维

完整规格

规模
1.74B · 32768 · 权重格式未知,无法估算显存
授权
cc-by-nc-4.0 · 不可商用
框架
transformers / sentence-transformers / vllm
访问提示
Hugging Face 可能需要代理

下载动量

30天下载 79.8k → 76.3k · likes +22

观测时间线