Elastic
Jina AI
模型
API
keyboard_arrow_down
Reader
把任意 URL 转成 Markdown,为大模型提供更好的事实依据。
向量模型
多模态多语言向量模型。
重排模型
让搜索相关性最大化的重排模型。
MCP
terminal
命令行
article
llms.txt
smart_toy
智能体
data_object
Schema
menu_book
文档
登录
login
向量模型
Qwen 研究许可证
open_in_new 发布博客

jina-embeddings-v4

用于多模态和多语言检索的通用向量模型
许可证
Qwen Research License
发布日期
calendar_month
2025-06-24
输入
abc
文本
image
图片
picture_as_pdf
PDF
arrow_forward
输出
more_horiz
向量
apps
多向量
Matryoshka 维度 help_outline
128
256
512
1024
2048
延迟分块 help_outline
check_circle
Yes
模型详情
参数: 3.8B
输入词元长度: 32K
输入图像尺寸: 768×28×28
输出维度: 2048
底座模型 help_outline
open_in_new
Qwen2.5-VL-3B-Instruct
已训练语言 help_outline
34 种语言
支持的语言 help_outline
29 种语言
量化 help_outline
GGUF
相关模型
link
jina-embeddings-v3
link
jina-clip-v2
支持的任务
search 检索
compare_arrows 文本匹配
code 代码
可通过以下方式获取
Jina API
Hugging Face
物理隔离
I/O 图 1

文本

jina-embeddings-v4

任务

向量

I/O 图 2

图片

jina-embeddings-v4

任务

向量

I/O 图 3

多个

向量

文本

jina-embeddings-v4

任务

I/O 图 4

多个

向量

图片

jina-embeddings-v4

任务

帕累托前沿 help_outline
workspace_premium
RTEB public
LongEmbed
CoIR
ViDoRe v1
MTEB English · retrieval
chevron_leftchevron_right
30M100M300M1B3.0B10B40506070bge-base-en-v1.5bge-m3bge-small-en-v1.5CodeRankEmbedCodeSage-baseCodeSage-largeCodeSage-large-v2CodeSage-smallCodeXEmbed-7BContrievere5-base-v2e5-mistral-7b-instructe5-small-v2granite-embedding-engli…granite-embedding-small…gte-base-en-v1.5gte-modernbert-basegte-Qwen2-1.5B-instructjina-code-embeddings-0.…jina-embeddings-v3modernbert-embed-baseNV-Embed-v2SFR-Embedding-2_RSFR-Embedding-Code-2B_RSFR-Embedding-Code-400M…snowflake-arctic-embed-…UniXcoderjina-embeddings-v4参数量(对数)nDCG@10
本模型
在前沿上
Jina AI
其他
CoIR
71.59
参数量
3.8B
按分数的排名
2 / 31
帕累托前沿
在前沿之后
取值分布help_outline
AUC 0.8308
语料
翻译对
文档检索
代码
图片 / 头图
图片 / 标识
任务
code.passage
code.query
code.query → code.passage
retrieval.passage
retrieval.query
retrieval.query → retrieval.passage
text-matching
0.8360.400.500.600.700.800.90
相关6.7%
困难负例1.1%
无关0.8%
推荐阈值
FPR 0.1 · 0.714
FPR 0.01 · 0.836
FPR 0.001 · 0.877
FPR 0.0001 · 0.896
均衡 · 0.618
AUC
0.8308
噪声上限
0.877
召回悬崖
0.516
测量样本对
119 / 11k
向量分量help_outline
-0.19-0.020.15
σ 0.0221 · 487k 个数值
向量几何help_outline
02048
各维度均值,悬停查看区间
噪声下限
0.496
有效维度
73 / 2048
维度截断help_outline
12825651210242048
text-matching · 阈值随所请求维度的变化
语言对help_outline
de-ruen-deen-koen-zhja-ko
各语言对之间的阈值跨度:0.069
选择要比较的模型
论文 (2)
ICLR 2026
一月 22, 2026
Embedding Compression via Spherical Coordinates
EMNLP 2025
六月 24, 2025
jina-embeddings-v4: Universal Embeddings for Multimodal Multilingual Retrieval

概述

jina-embeddings-v4 是一个 3.8B 参数的多模态向量模型,将文本和图像表示统一在单一架构中。它独特地支持单向量(dense)和多向量(late-interaction/ColBERT 风格)两种输出模式,使团队无需切换模型即可在索引效率和检索精度之间权衡。该模型在视觉丰富的文档检索上取得 SOTA 性能,原生处理表格、图表、示意图和混合媒体格式。

方法

该架构将大型 transformer 编码器主干与基于 Qwen2.5-VL 的视觉编码器相结合,通过共享注意力层处理文本(最多 32K token)和图像(768×28×28 补丁)。三个任务特定的 LoRA 适配器(各 60M 参数)使模型专门用于:非对称查询-文档检索、语义文本相似性和代码搜索。双输出设计是关键创新:模型可以生成单个 2048 维 dense 向量(用于快速 ANN 索引,可经 Matryoshka 截断到 128 维),或一组 128 维 token 级向量用于 late-interaction 打分。训练采用两阶段课程:在文本-图像和文本-文本对上联合对比预训练,然后是任务特定的 LoRA 适配器训练。对超出 32K token 上下文窗口的文档支持 late chunking。适用 Qwen Research License。

性能

在 JinaVDR(视觉文档检索)上,该模型平均得分 72.19,而 ColPali-v1.2 为 64.50。在 ViDoRe 上,它取得平均 84.11(多向量模式下 90.17),而 ColPali 为 83.90。跨模态检索在 CLIP 基准上达到 84.11,超过 jina-clip-v2(81.12)和 nllb-clip-large-siglip(83.19)。文本检索得分:MTEB-en 55.97、MMTEB 66.49、LongEmbed 67.11(jina-embeddings-v3 为 55.66)。语义相似度在 English STS 上达到 85.89,多语言 STS 上 72.70。代码检索在 CoIR 上得分 71.59。跨模态对齐达到 0.71 余弦相似度(OpenAI CLIP 为 0.15)。多向量模式在视觉丰富任务上一致优于单向量模式;单向量模式为标准文本检索提供高效性能。

最佳实践

根据流水线选择输出模式:大规模 ANN 索引用单向量(可用 Matryoshka 截断到 128–512 维),视觉丰富文档的 top-k 候选重排序用多向量。通过 API 任务参数选择 LoRA 适配器:查询-文档搜索用 'retrieval',语义相似性用 'text-matching',代码检索用 'code'。对超过 32K token 的文档,使用 `late_chunking。每个 LoRA 适配器的 60M 参数开销可忽略(内存增加 <2%),且三个适配器可同时加载。该模型在 Qwen Research License 下授权(无商用许可证不得商用)。生产部署请使用支持 CUDA 的 GPU;该模型可通过 Jina API、AWS、Azure 和 GCP 市场获取。纯文本工作负载可考虑 jina-embeddings-v5-text-small`,它以一小部分计算成本提供更高的每参数精度。

提及此模型的博客
三月 11, 2026 • 7 分钟阅读
从多模态大模型中引导音频向量模型
将任何多模态大模型转化为小型音频向量模型,仅需 1/25 的数据量即可超越 CLAP。
Han Xiao
Abstract illustration of a sound wave or heartbeat, formed by blue, orange, and gray dots on a white background.
二月 19, 2026 • 7 分钟阅读
jina-embeddings-v5-text:全新的 SOTA 小型多语言向量模型
两款性能领先的 1B 以下多语言向量模型,现已在 Elastic Inference Service、Llama.cpp 和 MLX 上可用。
Jina AI
Abstract digital artwork in black and white, featuring scattered dots forming letters in a halftone effect. The central lette
九月 09, 2025 • 11 分钟阅读
Llama.cpp 和 GGUF 中的多模态向量模型
我们为 llama.cpp 和 GGUF 引入了多模态 向量模型,并在过程中发现了一些令人惊讶的问题。
Andrei Ungureanu
Alex C-G
Cartoon llama in the center of a white background, emitting laser-like beams from its eyes. The illustration creates a playfu
九月 04, 2025 • 6 分钟阅读
Jina Code Embeddings:0.5B 和 1.5B 参数规模下的 SOTA 代码检索向量模型
代码生成大模型 → 代码向量模型:0.5B/1.5B 模型在 25 个代码检索基准测试中实现了 SOTA 性能。
Jina AI
Green "Code Embeddings" text displayed in a LED dot style on a black background, evoking a futuristic and technological atmos
八月 13, 2025 • 15 分钟阅读
针对仅解码器向量模型的 GGUF 优化
在 L4 GPU 上,一个 30 亿参数的向量模型达到 4000 词元/秒的速度,这可能已经是使用 llama.cpp 所能达到的最快速度了。真的是这样吗?
Han Xiao
Text "DGUF for Embedding Models" written in yellow on a dark background, conveying a sleek, minimalistic, digital design.
当前语言 / 主题
搜索底座
Reader
向量模型
重排模型
获取 Jina API 密钥
速率限制
关于我们
新闻
下载 Jina 标志
open_in_new
下载 Elastic 标志
open_in_new
API 状态
Elastic © 2026.安全条款及条件隐私管理 Cookie请勿出售或分享我的个人信息
本网站及其所有相关内容、软件、产品和服务仅供专业使用,不面向消费者。