Elastic
Jina AI
Modelli
API
keyboard_arrow_down
Reader
Converti qualsiasi URL in Markdown per un migliore ancoraggio dei LLM.
Embeddings
Embeddings multimodali e multilingue.
Reranker
Reranker per massimizzare la pertinenza dei risultati di ricerca.
MCP
terminal
CLI
article
llms.txt
smart_toy
Agenti
data_object
Schema
menu_book
Documenti
Login
login
Reranker
copyright CC BY-NC 4.0
open_in_new Post di rilascio

jina-reranker-v3

Reranker Listwise per il recupero di documenti multilingue SOTA
Licenza
copyright CC-BY-NC-4.0
Data di rilascio
calendar_month
2025-10-01
Ingresso
abc
Testo (query)
abc
Testo (Documento)
arrow_forward
Produzione
format_list_numbered
Classifiche
Dettagli del modello
Parametri: 597M
Lunghezza del token di input: 131K
Dimensione di uscita: 256
Modello base help_outline
open_in_new
Qwen3-0.6B
Lingue addestrate help_outline
24 lingue
Lingue supportate help_outline
93 lingue
Quantizzazioni help_outline
GGUF
Supporto Apple Silicon help_outline
MLX
Modelli correlati
link
jina-reranker-v3.5
link
jina-reranker-v2-base-multilingual
link
jina-reranker-m0
Disponibile tramite
Elastic Inference Service
API di Jina
AWS SageMaker
Microsoft Azure
Google Cloud
Hugging Face
Air-gapped
Grafico I/O

multiplo

Documento

Domanda

jina-reranker-v3

Classifica

Frontiera di Paretohelp_outline
BEIR
MIRACL
chevron_leftchevron_right
30M100M300M1B3.0B50556065answerai-colbert-small-…bge-reranker-basebge-reranker-v2-m3ColBERTv2GTE-ModernColBERT-v1jina-colbert-v2jina-reranker-m0jina-reranker-v1-base-enjina-reranker-v1-turbo-…jina-reranker-v2-base-m…jina-reranker-v3.5ms-marco-MiniLM-L-4-v2mxbai-rerank-base-v1mxbai-rerank-base-v2mxbai-rerank-large-v2mxbai-rerank-xsmall-v1Qwen3-Reranker-0.6Bjina-reranker-v3Parametri (log)nDCG@10
Questo modello
Sulla frontiera
Jina AI
Altri
BEIR
62.10
Parametri
597M
Classifica per punteggio
4 / 21
Frontiera di Pareto
Dietro
Distribuzione dei valorihelp_outline
AUC 0.8396
Corpus
Coppie di traduzione
Ricerca documentale
Codice
0.020-0.200.000.200.400.60
Correlate62.2%
Negativo difficile18.2%
Non correlate9.5%
Soglie consigliate
FPR 0.1 · 0.020
FPR 0.01 · 0.238
FPR 0.001 · 0.424
FPR 0.0001 · 0.600
bilanciata · -0.008
AUC
0.8396
Soglia del rumore
0.414
Crollo del richiamo
-0.185
Coppie misurate
119 / 2,856
Punteggio per posizionehelp_outline
12345678910
Punteggio medio a ogni posizione
Chi vince la prima posizionehelp_outline
Una corrispondenza corretta vince il 45% di 119 query
Sensibilità al poolhelp_outline
Posizione nella lista0.161
Dimensione del pool0.088
Difficoltà dei riempitivi0.015
Massima oscillazione di punteggio sulla stessa coppia
Scegli i modelli da confrontare
Pubblicazioni (1)
AAAI 2026
ottobre 01, 2025
jina-reranker-v3: Last but Not Late Interaction for Document Reranking

Panoramica

jina-reranker-v3 è un reranker listwise multilingue da 597M parametri che introduce l'interazione 'last but not late' (LBNL) — un cambio di paradigma rispetto al scoring cross-encoder a coppie. Invece di valutare ogni coppia query-documento in isolamento, elabora un'intera lista di documenti candidati simultaneamente all'interno di una singola finestra di contesto di 131K token, usando l'attenzione causale per catturare le relazioni tra documenti. Raggiunge una performance BEIR state-of-the-art (61,94 NDCG@10) con 2,5× meno parametri rispetto al concorrente più vicino.

Metodi

L'innovazione centrale è l'architettura LBNL. In un cross-encoder standard, ogni coppia query-documento viene punteggiata indipendentemente. In un modello a interazione tardiva (ColBERT), i documenti vengono codificati separatamente e abbinati token per token. LBNL combina i punti di forza di entrambi: la query e tutti i documenti candidati condividono un singolo contesto di attenzione causale, consentendo al modello di fare attenzione tra i documenti e catturare segnali di rilevanza relativa che il scoring a coppie trascura. Il modello elabora fino a 16 documenti per forward pass (uno positivo e 15 negativi durante l'addestramento), con ogni documento troncato a una lunghezza fissa. Gli embedding vengono estratti dall'ultimo token di ogni documento tramite Last-Token-Pooling, sfruttando il meccanismo di attenzione causale per aggregare naturalmente le informazioni dal contesto precedente. La finestra di contesto di 131K token è abilitata tramite embedding posizionali rotativi con frequenze base regolate. L'addestramento utilizza un curriculum progressivo in tre fasi con una perdita multi-obiettivo che combina InfoNCE, perdita dispersiva (peso 0,45), perdita di matching duale (peso 0,85) e perdita di similarità.

Prestazione

Sul BEIR, il modello raggiunge 61,94 NDCG@10, il più alto tra tutti i reranker valutati e un miglioramento del 4,88 % rispetto a jina-reranker-v2. Eccelle nella retrieval multi-hop (78,56 su HotpotQA) e nella verifica di fatti (93,95 su FEVER). Le prestazioni multilingua raggiungono 66,50 su MIRACL su 18 lingue, con 78,69 in arabo e 81,06 in tailandese. La retrieval di codice raggiunge 63,28 su CoIR. Supera il mxbai-rerank-large da 1,5B (61,44) con 2,5× meno parametri e mostra un miglioramento del 5,43 % rispetto a bge-reranker-v2-m3 alla stessa scala. La performance è relativamente stabile attraverso gli ordinamenti dei documenti: casuale (62,54), decrescente (61,94), crescente (61,52) — indicando uno scoring listwise robusto indipendente dall'ordinamento dei candidati.

Orientamento

Usa il template di prompt strutturato con i ruoli system/user/assistant e token speciali per l'estrazione degli embedding. Elabora fino a 64 documenti per forward pass per le collection che superano il contesto di 131K. Ottimale con i documenti ordinati casualmente o per rilevanza decrescente (la differenza di performance è <1 %). Sfrutta la capacità di interazione tra documenti per i task di ranking comparativo — il design listwise del modello cattura le relazioni tra candidati che lo scoring a coppie trascura. Per le applicazioni multilingua, il modello offre un solido transfer zero-shot su 18 lingue. Implementa l'elaborazione batch per grandi insiemi di documenti, mantenendo gli embedding di query coerenti tra i batch. Gli embedding di output a 256 dimensioni supportano un calcolo di similarità efficiente. Ideale per i task di ragionamento multi-hop e verifica di fatti. Per la produzione, usa jina-reranker-v3.5 per un'inferenza 1,22–1,56× più veloce tramite l'attenzione ibrida.

Blog che menzionano questo modello
agosto 03, 2026 • 11 minuti letti
jina-reranker-v3.5: Faster Listwise Reranking with Hybrid Attention and Self-Distillation
A 0.6B listwise reranker that beats Qwen3-Reranker-4B on BEIR, reranks up to 1.56x faster than v3, and gains 9.6 nDCG@10 on semi-structured retrieval.
Jina AI
ottobre 03, 2025 • 7 minuti letti
Jina Reranker v3: 0.6B Listwise Reranker for SOTA Multilingual Retrieval
New 0.6B-parameter listwise reranker that considers the query and all candidate documents in a single context window.
Jina AI
Light blue background with stylized text in the center, composed of small dots or squares, evoking a modern and minimalistic
gennaio 22, 2025 • 10 minuti letti
What Should We Learn From ModernBERT?
Bigger training data, efficient parameter sizing, and a deep-but-thin architecture, ModernBERT sets a direction for future BERT-like models.
Nan Wang
Alex C-G
Futuristic illustration with a central white circle surrounded by white dots on a dotted background.
settembre 18, 2024 • 10 minuti letti
Jina Embeddings v3: A Frontier Multilingual Embedding Model
jina-embeddings-v3 is a frontier multilingual text embedding model with 570M parameters and 8192 token-length, outperforming the latest proprietary embeddings from OpenAI and Cohere on MTEB.
Jina AI
Dynamic image showing the characters "V3" formed by bright green dots varying in size on a black background.
Lingua / tema attuale
Search Foundation
Reader
Embeddings
Reranker
Ottieni la chiave API Jina
Limite di velocità
Chi siamo
Notizie
Scarica il logo Jina
open_in_new
Scarica il logo Elastic
open_in_new
Stato dell'API
Elastic © 2026.SicurezzaTermini & CondizioniPrivacyGestisci i cookieNon vendere né condividere le mie informazioni personali
Questo sito web e tutti i contenuti, software, prodotti e servizi ad esso associati sono destinati esclusivamente all'uso professionale. Non è previsto né raccomandato alcun utilizzo da parte dei consumatori.