Elastic
Jina AI
模型
API
keyboard_arrow_down
Reader
把任意 URL 转成 Markdown,为大模型提供更好的事实依据。
向量模型
多模态多语言向量模型。
重排模型
让搜索相关性最大化的重排模型。
MCP
terminal
命令行
article
llms.txt
smart_toy
智能体
data_object
Schema
menu_book
文档
登录
login
warning
此模型已被更新的模型取代。
重排模型
copyright CC BY-NC 4.0
open_in_new 发布博客

jina-reranker-v2-base-multilingual

支持多语言、函数调用和代码搜索的交叉编码器重排模型。
许可证
copyright CC-BY-NC-4.0
发布日期
calendar_month
2024-06-25
输入
abc
文本(查询)
abc
文本(文档)
arrow_forward
输出
format_list_numbered
排名
模型详情
参数: 278M
输入词元长度: 1K
底座模型 help_outline
jina-xlm-roberta
已训练语言 help_outline
24 种语言
支持的语言 help_outline
108 种语言
相关模型
link
jina-reranker-v1-base-en
link
jina-reranker-v1-turbo-en
link
jina-reranker-v1-tiny-en
可通过以下方式获取
Elastic Inference Service
Jina API
AWS SageMaker
微软云
谷歌云
Hugging Face
物理隔离
I/O 图

多个

文档

查询

jina-reranker-v2-base-multilingual

排序

帕累托前沿help_outline
BEIR
MIRACL
chevron_leftchevron_right
30M100M300M1B3.0B50556065answerai-colbert-small-…bge-reranker-basebge-reranker-v2-m3ColBERTv2GTE-ModernColBERT-v1jina-colbert-v2jina-reranker-m0jina-reranker-v1-base-enjina-reranker-v1-turbo-…jina-reranker-v3jina-reranker-v3.5ms-marco-MiniLM-L-4-v2mxbai-rerank-base-v1mxbai-rerank-base-v2mxbai-rerank-large-v2mxbai-rerank-xsmall-v1Qwen3-Reranker-0.6Bjina-reranker-v2-base-m…参数量(对数)nDCG@10
本模型
在前沿上
Jina AI
其他
BEIR
57.06
参数量
278M
按分数的排名
7 / 21
帕累托前沿
在前沿上
取值分布help_outline
AUC 0.8574
语料
翻译对
文档检索
代码
0.3670.200.400.600.80
相关63.0%
困难负例19.0%
无关9.9%
推荐阈值
FPR 0.1 · 0.367
FPR 0.01 · 0.683
FPR 0.001 · 0.839
FPR 0.0001 · 0.862
均衡 · 0.270
AUC
0.8574
噪声上限
0.832
召回悬崖
0.061
测量样本对
119 / 2,856
各名次得分help_outline
12345678910
各名次位置上的平均得分
谁排在第一位help_outline
119 个查询中有 50% 由正确结果夺得第一
选择要比较的模型

概述

jina-reranker-v2-base-multilingual 是一个 278M 参数的 cross-encoder 重排序模型,支持 100 多种语言,具有 1,024 token 的上下文窗口(使用 Flash Attention 2 时为 524,288 token)。它是打破仅限英语限制的首个 Jina 重排序器,在 AirBench 上取得 SOTA 性能,并在包括函数调用和 SQL 模式匹配在内的结构化数据任务上表现强劲。它处理文档的速度比同类模型快 15 倍。

方法

该模型采用经 Flash Attention 2 增强的 cross-encoder 架构,使查询与文档能跨越语言障碍直接比较。278M 参数的 BERT 编码器对 1,024 token 的基础上下文(使用 Flash Attention 2 可扩展至 524,288 token)使用对称双向注意力和 ALiBi 位置编码。训练遵循四阶段渐进过程:(1) 英语能力,(2) 跨语言对齐,(3) 多语言数据纳入,(4) 困难负样本精炼。这种分阶段方法防止了向单语言模型添加多语言数据时常发生的灾难性遗忘。Flash Attention 2 实现是关键的效率创新,实现了比 bge-reranker-v2-m3 高 15 倍的吞吐量。

性能

该模型在面向 RAG 系统的 AirBench 排行榜上取得 SOTA 性能,并在 MKQA(26 种语言)上表现强劲。它在结构化数据任务上表现卓越:ToolBench(函数调用)上的高召回率和 NSText2SQL(SQL 模式匹配)。最令人印象深刻的是,它比 bge-reranker-v2-m3 等同类模型快 15 倍地处理文档,使其适用于实时应用。100 多种语言支持加上结构化数据能力,使其特别适合智能体 RAG 系统和多语言 API 文档搜索。2026 年,jina-reranker-v3.5 以 listwise 交互、131K 上下文和领域特定训练取代该模型。

最佳实践

该模型需要支持 CUDA 的 GPU,可通过 Jina Reranker API、主要 RAG 框架(Haystack、LangChain)和云市场(AWS、Azure、GCP)访问。它在需要跨越语言障碍和数据类型的精确理解场景中表现出色:处理多语言内容的全球企业、API 文档搜索、多语言代码库中的代码检索。凭借 1,024 token 的上下文窗口和针对较长文档的自动分块,它高效处理扩展内容。当你需要跨语言提升搜索准确率、需要智能体 RAG 的函数调用能力、或想改进多语言代码库的代码搜索时,使用此模型。对于新项目,jina-reranker-v3.5 提供 listwise 排序、131K 上下文和领域特定改进。

提及此模型的博客
十月 03, 2025 • 7 分钟阅读
Jina Reranker v3: 0.6B Listwise Reranker for SOTA Multilingual Retrieval
New 0.6B-parameter listwise reranker that considers the query and all candidate documents in a single context window.
Jina AI
Light blue background with stylized text in the center, composed of small dots or squares, evoking a modern and minimalistic
四月 16, 2025 • 10 分钟阅读
On the Size Bias of Text Embeddings and Its Impact in Search
Size bias refers to how the length of text inputs affects similarity, regardless of semantic relevance. It explains why search systems sometimes return long, barely-relevant documents instead of shorter, more precise matches to your query.
Scott Martens
Black background with a simple white ruler marked in centimeters, emphasizing a minimalist design.
四月 08, 2025 • 21 分钟阅读
jina-reranker-m0: Multilingual Multimodal Document Reranker
Introducing jina-reranker-m0, our new multilingual multimodal reranker for retrieving visual documents, with SOTA performance on multilingual long documents and code searching tasks.
Jina AI
Modern dot matrix text display on a dark blue background, conveying a digital feel.
四月 01, 2025 • 17 分钟阅读
Using DeepSeek R1 Reasoning Model in DeepSearch
Standard LLM or reasoning model, which is better for DeepSearch? In this post, we explored using DeepSeek-R1 in the DeepSearch implementation for choosing the next action.
Andrei Ungureanu
Alex C-G
Brown background with a stylized whale graphic and the text "THINK:" and ":SEARCH>" in code-like font.
三月 12, 2025 • 11 分钟阅读
Snippet Selection and URL Ranking in DeepSearch/DeepResearch
Nailing these two details takes your DeepSearch from mid to GOAT: selecting the best snippets from lengthy webpages and ranking URLs before crawling.
Han Xiao
Logo with words "THINK SEARCH THINK" in black dot and arrow patterns on an orange background, accompanied by horizontal lines
当前语言 / 主题
搜索底座
Reader
向量模型
重排模型
获取 Jina API 密钥
速率限制
关于我们
新闻
下载 Jina 标志
open_in_new
下载 Elastic 标志
open_in_new
API 状态
Elastic © 2026.安全条款及条件隐私管理 Cookie请勿出售或分享我的个人信息
本网站及其所有相关内容、软件、产品和服务仅供专业使用,不面向消费者。