Elastic
Jina AI
模型
API
keyboard_arrow_down
Reader
把任意 URL 转成 Markdown,为大模型提供更好的事实依据。
向量模型
多模态多语言向量模型。
重排模型
让搜索相关性最大化的重排模型。
MCP
terminal
命令行
article
llms.txt
smart_toy
智能体
data_object
Schema
menu_book
文档
登录
login
重排模型
copyright CC BY-NC 4.0
open_in_new 发布博客

jina-reranker-v3

面向业界领先的多语言文档检索的 listwise 重排序器
许可证
copyright CC-BY-NC-4.0
发布日期
calendar_month
2025-10-01
输入
abc
文本(查询)
abc
文本(文档)
arrow_forward
输出
format_list_numbered
排名
模型详情
参数: 597M
输入词元长度: 131K
输出维度: 256
底座模型 help_outline
open_in_new
Qwen3-0.6B
已训练语言 help_outline
24 种语言
支持的语言 help_outline
93 种语言
量化 help_outline
GGUF
苹果芯片支持 help_outline
MLX
相关模型
link
jina-reranker-v3.5
link
jina-reranker-v2-base-multilingual
link
jina-reranker-m0
可通过以下方式获取
Elastic Inference Service
Jina API
AWS SageMaker
微软云
谷歌云
Hugging Face
物理隔离
I/O 图

多个

文档

查询

jina-reranker-v3

排序

帕累托前沿help_outline
BEIR
MIRACL
chevron_leftchevron_right
30M100M300M1B3.0B50556065answerai-colbert-small-…bge-reranker-basebge-reranker-v2-m3ColBERTv2GTE-ModernColBERT-v1jina-colbert-v2jina-reranker-m0jina-reranker-v1-base-enjina-reranker-v1-turbo-…jina-reranker-v2-base-m…jina-reranker-v3.5ms-marco-MiniLM-L-4-v2mxbai-rerank-base-v1mxbai-rerank-base-v2mxbai-rerank-large-v2mxbai-rerank-xsmall-v1Qwen3-Reranker-0.6Bjina-reranker-v3参数量(对数)nDCG@10
本模型
在前沿上
Jina AI
其他
BEIR
62.10
参数量
597M
按分数的排名
4 / 21
帕累托前沿
在前沿之后
取值分布help_outline
AUC 0.8396
语料
翻译对
文档检索
代码
0.020-0.200.000.200.400.60
相关62.2%
困难负例18.2%
无关9.5%
推荐阈值
FPR 0.1 · 0.020
FPR 0.01 · 0.238
FPR 0.001 · 0.424
FPR 0.0001 · 0.600
均衡 · -0.008
AUC
0.8396
噪声上限
0.414
召回悬崖
-0.185
测量样本对
119 / 2,856
各名次得分help_outline
12345678910
各名次位置上的平均得分
谁排在第一位help_outline
119 个查询中有 45% 由正确结果夺得第一
候选集敏感度help_outline
在列表中的位置0.161
候选集大小0.088
干扰项难度0.015
同一样本对上的最大得分波动
选择要比较的模型
论文 (1)
AAAI 2026
十月 01, 2025
jina-reranker-v3: Last but Not Late Interaction for Document Reranking

概述

jina-reranker-v3 是一个 597M 参数的多语言 listwise 重排序模型,引入了 'last but not late'(LBNL)交互——这是相对于成对 cross-encoder 打分的一次范式转变。它不是孤立地评估每个查询-文档对,而是在单个 131K token 上下文窗口内同时处理整个候选文档列表,利用因果注意力捕捉文档间关系。它仅用最接近竞品 2.5 分之一的参数量,便实现了 SOTA 的 BEIR 性能(61.94 NDCG@10)。

方法

核心创新是 LBNL 架构。在标准 cross-encoder 中,每个查询-文档对独立打分。在 late-interaction 模型(ColBERT)中,文档单独编码并按 token 匹配。LBNL 结合了两者的优势:查询和所有候选文档共享单个因果注意力上下文,使模型能跨文档关注并捕捉成对打分遗漏的相对相关性信号。模型每次前向处理最多 16 个文档(训练时 1 个正例、15 个负例),每个文档被截断到固定长度。向量通过 Last-Token-Pooling 从每个文档的最后一个 token 提取,利用因果注意力机制自然地聚合前序上下文的信息。131K token 上下文窗口通过调整基频的旋转位置编码实现。训练使用三阶段渐进课程,结合 InfoNCE、离散损失(权重 0.45)、双匹配损失(权重 0.85)和相似度损失的多目标损失。

性能

在 BEIR 上,该模型达到 61.94 NDCG@10,是评估的所有重排序器中最高的,较 jina-reranker-v2 提升 4.88%。它在多跳检索(HotpotQA 78.56)和事实验证(FEVER 93.95)上表现卓越。多语言性能在 18 种语言上 MIRACL 达 66.50,其中阿拉伯语 78.69、泰语 81.06。代码检索在 CoIR 上达 63.28。它的参数量仅为 1.5B 的 mxbai-rerank-large 的 2.5 分之一,便超越了后者(61.44),并较同规模的 bge-reranker-v2-m3 提升 5.43%。性能在不同文档顺序下相对稳定:随机(62.54)、降序(61.94)、升序(61.52)——表明稳健的 listwise 打分不受候选顺序影响。

最佳实践

使用带 system/user/assistant 角色和特殊 token 的结构化提示模板进行向量提取。对于超过 131K 上下文的集合,每次前向最多处理 64 个文档。文档随机排序或按相关性降序排序时效果最佳(性能差异 <1%)。利用跨文档交互能力处理比较排序任务——模型的 listwise 设计能捕捉成对打分遗漏的候选间关系。对于多语言应用,模型在 18 种语言上提供强大的零样本迁移。为大型文档集实现批处理,在批次间保持查询向量一致。256 维输出向量支持高效的相似度计算。适合多跳推理和事实验证任务。生产环境请使用 jina-reranker-v3.5,通过混合注意力实现 1.22–1.56 倍更快的推理。

提及此模型的博客
八月 03, 2026 • 11 分钟阅读
jina-reranker-v3.5: Faster Listwise Reranking with Hybrid Attention and Self-Distillation
A 0.6B listwise reranker that beats Qwen3-Reranker-4B on BEIR, reranks up to 1.56x faster than v3, and gains 9.6 nDCG@10 on semi-structured retrieval.
Jina AI
十月 03, 2025 • 7 分钟阅读
Jina Reranker v3: 0.6B Listwise Reranker for SOTA Multilingual Retrieval
New 0.6B-parameter listwise reranker that considers the query and all candidate documents in a single context window.
Jina AI
Light blue background with stylized text in the center, composed of small dots or squares, evoking a modern and minimalistic
一月 22, 2025 • 10 分钟阅读
What Should We Learn From ModernBERT?
Bigger training data, efficient parameter sizing, and a deep-but-thin architecture, ModernBERT sets a direction for future BERT-like models.
Nan Wang
Alex C-G
Futuristic illustration with a central white circle surrounded by white dots on a dotted background.
九月 18, 2024 • 10 分钟阅读
Jina Embeddings v3: A Frontier Multilingual Embedding Model
jina-embeddings-v3 is a frontier multilingual text embedding model with 570M parameters and 8192 token-length, outperforming the latest proprietary embeddings from OpenAI and Cohere on MTEB.
Jina AI
Dynamic image showing the characters "V3" formed by bright green dots varying in size on a black background.
当前语言 / 主题
搜索底座
Reader
向量模型
重排模型
获取 Jina API 密钥
速率限制
关于我们
新闻
下载 Jina 标志
open_in_new
下载 Elastic 标志
open_in_new
API 状态
Elastic © 2026.安全条款及条件隐私管理 Cookie请勿出售或分享我的个人信息
本网站及其所有相关内容、软件、产品和服务仅供专业使用,不面向消费者。