I/O 图
Pareto fronthelp_outline
chevron_leftchevron_right
This model
On the front
Jina AI
Other
BEIR
57.06
Parameters
278M
Rank by score
7 / 21
Pareto front
On it
取值分布help_outlineAUC 0.8574
语料
翻译对
文档检索
代码
相关63.0%
困难负例19.0%
无关9.9%
推荐阈值
FPR 0.1 · 0.367
FPR 0.01 · 0.683
FPR 0.001 · 0.839
FPR 0.0001 · 0.862
均衡 · 0.270
AUC
0.8574
噪声上限
0.832
召回悬崖
0.061
测量样本对
119 / 2,856
各名次得分help_outline
各名次位置上的平均得分
谁排在第一位help_outline
119 个查询中有 50% 由正确结果夺得第一
选择要比较的模型
概述
Jina Reranker v2 Base Multilingual 是一款交叉编码器模型,旨在跨越语言与数据类型的界限提升搜索准确率。它解决了多语言环境下精准信息检索的核心难题,对于需要在不同语言和内容类型间精排搜索结果的跨国企业尤其有价值。该模型支持 100 多种语言,还具备函数调用和代码搜索方面的独特能力,可为国际化内容、API 文档和多语言代码库提供统一的搜索精排方案。2.78 亿参数的紧凑设计,也让追求性能与资源效率平衡的团队格外青睐。
方法
该模型采用交叉编码器架构,并引入 Flash Attention 2,可直接比对查询与文档,相关性评估更为准确。训练分四个阶段:先打好英语基础,再逐步引入跨语言和多语言数据,最后用难负样本做收尾精调。这套创新训练方法配合 Flash Attention 2,让模型支持最长 1024 词元的上下文,更长的文档可自动分块处理。高效的架构使它能胜任跨语言的复杂重排任务,吞吐量达到上一代的 6 倍,同时凭借查询与文档的直接交互确保相关性评估准确。
性能
在实际评估中,该模型在各类基准上都表现出色。它在面向 RAG 系统的 AirBench 榜单上达到业界领先水平,多语言任务同样成绩优异,包括覆盖 26 种语言的 MKQA 数据集。结构化数据任务上的优势尤为明显,函数调用(ToolBench 基准)和 SQL 表结构匹配(NSText2SQL 基准)都取得了很高的召回率。最难得的是,它在拿下这些成绩的同时,文档处理速度比 bge-reranker-v2-m3 等同类模型快 15 倍,完全能胜任实时应用。不过请注意,要发挥最佳性能,推理时需要支持 CUDA 的 GPU。
最佳实践
该模型需要支持 CUDA 的 GPU 才能发挥最佳性能,可通过多种渠道使用:Reranker API、Haystack 和 LangChain 等主流 RAG 框架,或通过云市场进行私有化部署。它擅长跨语言、跨数据类型的精准理解,非常适合需要处理多语言内容、API 文档或代码库的全球化企业。模型具备 1024 词元的上下文窗口,并对较长文档自动分块,可高效处理长内容。如果您需要提升跨语言搜索准确率、为智能体 RAG 系统提供函数调用能力,或改进跨多语言代码库的代码搜索,都可以考虑使用该模型。它与向量搜索系统配合使用时效果尤为明显,能大幅提升检索结果的最终排序质量。
提及此模型的博客









