Elastic
Jina AI
模型
API
keyboard_arrow_down
Reader
把任意 URL 轉成 Markdown,為大模型提供更好的事實依據。
向量模型
多模態多語言向量模型。
重排模型
讓搜尋相關性最大化的重排模型。
MCP
terminal
命令列
article
llms.txt
smart_toy
智慧體
data_object
Schema
menu_book
文件
登入
login
warning
此模型已被更新的模型取代。
重排模型
copyright CC BY-NC 4.0
open_in_new 釋出部落格

jina-reranker-v2-base-multilingual

支援多語言、函式呼叫和程式碼搜尋的交叉編碼器重排模型。
許可證
copyright CC-BY-NC-4.0
釋出日期
calendar_month
2024-06-25
輸入
abc
文字(查詢)
abc
文字(文件)
arrow_forward
輸出
format_list_numbered
排名
模型詳情
參數: 278M
輸入詞元長度: 1K
底座模型 help_outline
jina-xlm-roberta
已訓練語言 help_outline
24 種語言
支援的語言 help_outline
108 種語言
相關模型
link
jina-reranker-v1-base-en
link
jina-reranker-v1-turbo-en
link
jina-reranker-v1-tiny-en
可透過以下方式獲取
Elastic Inference Service
Jina API
AWS SageMaker
Microsoft Azure
谷歌雲
Hugging Face
物理隔離
I/O 圖

多個

文件

查詢

jina-reranker-v2-base-multilingual

排序

帕累託前緣help_outline
BEIR
MIRACL
chevron_leftchevron_right
30M100M300M1B3.0B50556065answerai-colbert-small-…bge-reranker-basebge-reranker-v2-m3ColBERTv2GTE-ModernColBERT-v1jina-colbert-v2jina-reranker-m0jina-reranker-v1-base-enjina-reranker-v1-turbo-…jina-reranker-v3jina-reranker-v3.5ms-marco-MiniLM-L-4-v2mxbai-rerank-base-v1mxbai-rerank-base-v2mxbai-rerank-large-v2mxbai-rerank-xsmall-v1Qwen3-Reranker-0.6Bjina-reranker-v2-base-m…參數量(對數)nDCG@10
本模型
在前緣上
Jina AI
其他
BEIR
57.06
參數量
278M
按分數的排名
7 / 21
帕累託前緣
在前緣上
取值分佈help_outline
AUC 0.8574
語料
翻譯對
文件檢索
程式碼
0.3670.200.400.600.80
相關63.0%
困難負例19.0%
無關9.9%
推薦閾值
FPR 0.1 · 0.367
FPR 0.01 · 0.683
FPR 0.001 · 0.839
FPR 0.0001 · 0.862
均衡 · 0.270
AUC
0.8574
噪聲上限
0.832
召回懸崖
0.061
測量樣本對
119 / 2,856
各名次得分help_outline
12345678910
各名次位置上的平均得分
誰排在第一位help_outline
119 個查詢中有 50% 由正確結果奪得第一
選擇要比較的模型

概述

jina-reranker-v2-base-multilingual 是一個 278M 參數的 cross-encoder 重排序模型,支援 100 多種語言,具有 1,024 token 的上下文視窗(使用 Flash Attention 2 時為 524,288 token)。它是打破僅限英語限制的首個 Jina 重排序器,在 AirBench 上取得 SOTA 效能,並在包括函數呼叫和 SQL 模式匹配在內的結構化資料任務上表現強勁。它處理文件的速度比同類模型快 15 倍。

方法

該模型採用經 Flash Attention 2 增強的 cross-encoder 架構,使查詢與文件能跨越語言障礙直接比較。278M 參數的 BERT 編碼器對 1,024 token 的基礎上下文(使用 Flash Attention 2 可擴展至 524,288 token)使用對稱雙向注意力和 ALiBi 位置編碼。訓練遵循四階段漸進過程:(1) 英語能力,(2) 跨語言對齊,(3) 多語言資料納入,(4) 困難負樣本精化。這種分階段方法防止了向單語模型添加多語言資料時常發生的災難性遺忘。Flash Attention 2 實現是關鍵的效率創新,實現了比 bge-reranker-v2-m3 高 15 倍的吞吐量。

效能

該模型在面向 RAG 系統的 AirBench 排行榜上取得 SOTA 效能,並在 MKQA(26 種語言)上表現強勁。它在結構化資料任務上表現卓越:ToolBench(函數呼叫)上的高召回率和 NSText2SQL(SQL 模式匹配)。最令人印象深刻的是,它比 bge-reranker-v2-m3 等同類模型快 15 倍地處理文件,使其適用於即時應用。100 多種語言支援加上結構化資料能力,使其特別適合智能體 RAG 系統和多語言 API 文件搜尋。2026 年,jina-reranker-v3.5 以 listwise 交互、131K 上下文和領域特定訓練取代該模型。

最佳實踐

該模型需要支援 CUDA 的 GPU,可透過 Jina Reranker API、主要 RAG 框架(Haystack、LangChain)和雲市場(AWS、Azure、GCP)存取。它在需要跨越語言障礙和資料類型的精確理解場景中表現出色:處理多語言內容的全球企業、API 文件搜尋、多語言程式碼庫中的程式碼檢索。憑藉 1,024 token 的上下文視窗和針對較長文件的自動分塊,它高效處理擴展內容。當你需要跨語言提升搜尋準確率、需要智能體 RAG 的函數呼叫能力、或想改進多語言程式碼庫的程式碼搜尋時,使用此模型。對於新專案,jina-reranker-v3.5 提供 listwise 排序、131K 上下文和領域特定改進。

提及此模型的部落格
十月 03, 2025 • 7 分鐘閱讀
Jina Reranker v3: 0.6B Listwise Reranker for SOTA Multilingual Retrieval
New 0.6B-parameter listwise reranker that considers the query and all candidate documents in a single context window.
Jina AI
Light blue background with stylized text in the center, composed of small dots or squares, evoking a modern and minimalistic
四月 16, 2025 • 10 分鐘閱讀
On the Size Bias of Text Embeddings and Its Impact in Search
Size bias refers to how the length of text inputs affects similarity, regardless of semantic relevance. It explains why search systems sometimes return long, barely-relevant documents instead of shorter, more precise matches to your query.
Scott Martens
Black background with a simple white ruler marked in centimeters, emphasizing a minimalist design.
四月 08, 2025 • 21 分鐘閱讀
jina-reranker-m0: Multilingual Multimodal Document Reranker
Introducing jina-reranker-m0, our new multilingual multimodal reranker for retrieving visual documents, with SOTA performance on multilingual long documents and code searching tasks.
Jina AI
Modern dot matrix text display on a dark blue background, conveying a digital feel.
四月 01, 2025 • 17 分鐘閱讀
Using DeepSeek R1 Reasoning Model in DeepSearch
Standard LLM or reasoning model, which is better for DeepSearch? In this post, we explored using DeepSeek-R1 in the DeepSearch implementation for choosing the next action.
Andrei Ungureanu
Alex C-G
Brown background with a stylized whale graphic and the text "THINK:" and ":SEARCH>" in code-like font.
三月 12, 2025 • 11 分鐘閱讀
Snippet Selection and URL Ranking in DeepSearch/DeepResearch
Nailing these two details takes your DeepSearch from mid to GOAT: selecting the best snippets from lengthy webpages and ranking URLs before crawling.
Han Xiao
Logo with words "THINK SEARCH THINK" in black dot and arrow patterns on an orange background, accompanied by horizontal lines
當前語言 / 主題
搜尋底座
Reader
向量模型
重排模型
獲取 Jina API 金鑰
速率限制
關於我們
新聞
下載 Jina 標誌
open_in_new
下載 Elastic 標誌
open_in_new
API 狀態
Elastic © 2026.安全條款及條件隱私管理 Cookie請勿出售或分享我的個人資訊
本網站及其所有相關內容、軟體、產品和服務僅供專業使用,不面向消費者。