I/O 圖
Pareto fronthelp_outline
chevron_leftchevron_right
This model
On the front
Jina AI
Other
BEIR
57.06
Parameters
278M
Rank by score
7 / 21
Pareto front
On it
取值分佈help_outlineAUC 0.8574
語料
翻譯對
文件檢索
程式碼
相關63.0%
困難負例19.0%
無關9.9%
推薦閾值
FPR 0.1 · 0.367
FPR 0.01 · 0.683
FPR 0.001 · 0.839
FPR 0.0001 · 0.862
均衡 · 0.270
AUC
0.8574
噪聲上限
0.832
召回懸崖
0.061
測量樣本對
119 / 2,856
各名次得分help_outline
各名次位置上的平均得分
誰排在第一位help_outline
119 個查詢中有 50% 由正確結果奪得第一
選擇要比較的模型
概述
Jina Reranker v2 Base Multilingual 是一款交叉編碼器模型,旨在跨越語言與資料類型的界限提升搜尋準確率。它解決了多語言環境下精準資訊檢索的核心難題,對於需要在不同語言和內容類型間精排搜尋結果的跨國企業尤其有價值。該模型支援 100 多種語言,還具備函式呼叫和程式碼搜尋方面的獨特能力,可為國際化內容、API 文件和多語言程式碼庫提供統一的搜尋精排方案。2.78 億參數的緊湊設計,也讓追求效能與資源效率平衡的團隊格外青睞。
方法
該模型採用交叉編碼器架構,並引入 Flash Attention 2,可直接比對查詢與文件,相關性評估更為準確。訓練分四個階段:先打好英語基礎,再逐步引入跨語言和多語言資料,最後用難負樣本做收尾精調。這套創新訓練方法配合 Flash Attention 2,讓模型支援最長 1024 詞元的上下文,更長的文件可自動分塊處理。高效的架構使它能勝任跨語言的複雜重排任務,吞吐量達到上一代的 6 倍,同時憑藉查詢與文件的直接互動確保相關性評估準確。
效能
在實際評估中,該模型在各類基準上都表現出色。它在面向 RAG 系統的 AirBench 榜單上達到業界領先水平,多語言任務同樣成績優異,包括覆蓋 26 種語言的 MKQA 資料集。結構化資料任務上的優勢尤為明顯,函式呼叫(ToolBench 基準)和 SQL 表結構匹配(NSText2SQL 基準)都取得了很高的召回率。最難得的是,它在拿下這些成績的同時,文件處理速度比 bge-reranker-v2-m3 等同類模型快 15 倍,完全能勝任實時應用。不過請注意,要發揮最佳效能,推理時需要支援 CUDA 的 GPU。
最佳實踐
該模型需要支援 CUDA 的 GPU 才能發揮最佳效能,可透過多種渠道使用:Reranker API、Haystack 和 LangChain 等主流 RAG 框架,或透過雲市場進行私有化部署。它擅長跨語言、跨資料型別的精準理解,非常適合需要處理多語言內容、API 文件或程式碼庫的全球化企業。模型具備 1024 詞元的上下文視窗,並對較長文件自動分塊,可高效處理長內容。如果您需要提升跨語言搜尋準確率、為智慧體 RAG 系統提供函式呼叫能力,或改進跨多語言程式碼庫的程式碼搜尋,都可以考慮使用該模型。它與向量搜尋系統配合使用時效果尤為明顯,能大幅提升檢索結果的最終排序品質。
提及此模型的部落格









