Elastic
Jina AI
Modèles
API
keyboard_arrow_down
Reader
Convertissez n'importe quelle URL en Markdown pour un meilleur grounding des LLM.
Embeddings
Embeddings multimodales et multilingues.
Reclasseur
Outil de reclassement pour optimiser la pertinence des résultats de recherche.
MCP
terminal
CLI
article
llms.txt
smart_toy
Agents
data_object
Schéma
menu_book
Documents
Se connecter
login
Reclasseur
copyright CC BY-NC 4.0
open_in_new Article de lancement

jina-reranker-v3

Listwise reranker pour la recherche de documents multilingues SOTA
Licence
copyright CC-BY-NC-4.0
Date de sortie
calendar_month
2025-10-01
Saisie
abc
Texte (requête)
abc
Texte (Document)
arrow_forward
Sortir
format_list_numbered
Classements
Détails du modèle
Paramètres: 597M
Longueur du token d'entrée: 131K
Dimension de sortie: 256
Modèle de base help_outline
open_in_new
Qwen3-0.6B
Langues enseignées help_outline
24 langues
Langues prises en charge help_outline
93 langues
Quantifications help_outline
GGUF
Prise en charge d'Apple Silicon help_outline
MLX
Modèles associés
link
jina-reranker-v3.5
link
jina-reranker-v2-base-multilingual
link
jina-reranker-m0
Disponible via
Elastic Inference Service
API Jina
AWS SageMaker
Microsoft Azure
Google Cloud
Hugging Face
Air-gapped
Graphique d'E/S

multiple

Document

Requête

jina-reranker-v3

Classement

Frontière de Paretohelp_outline
BEIR
MIRACL
chevron_leftchevron_right
30M100M300M1B3.0B50556065answerai-colbert-small-…bge-reranker-basebge-reranker-v2-m3ColBERTv2GTE-ModernColBERT-v1jina-colbert-v2jina-reranker-m0jina-reranker-v1-base-enjina-reranker-v1-turbo-…jina-reranker-v2-base-m…jina-reranker-v3.5ms-marco-MiniLM-L-4-v2mxbai-rerank-base-v1mxbai-rerank-base-v2mxbai-rerank-large-v2mxbai-rerank-xsmall-v1Qwen3-Reranker-0.6Bjina-reranker-v3Paramètres (log)nDCG@10
Ce modèle
Sur la frontière
Jina AI
Autres
BEIR
62.10
Paramètres
597M
Rang par score
4 / 21
Frontière de Pareto
Derrière
Distribution des valeurshelp_outline
AUC 0.8396
Corpus
Paires de traduction
Recherche documentaire
Code
0.020-0.200.000.200.400.60
Liées62.2%
Négatif difficile18.2%
Non liées9.5%
Seuils recommandés
FPR 0.1 · 0.020
FPR 0.01 · 0.238
FPR 0.001 · 0.424
FPR 0.0001 · 0.600
équilibré · -0.008
AUC
0.8396
Plafond de bruit
0.414
Décrochage du rappel
-0.185
Paires mesurées
119 / 2,856
Score par ranghelp_outline
12345678910
Score moyen à chaque position de rang
Ce qui gagne le rang 1help_outline
Une correspondance correcte gagne 45 % des 119 requêtes
Sensibilité au poolhelp_outline
Position dans la liste0.161
Taille du pool0.088
Difficulté du remplissage0.015
Plus grand écart de score sur une même paire
Choisissez les modèles à comparer
Publications (1)
AAAI 2026
octobre 01, 2025
jina-reranker-v3: Last but Not Late Interaction for Document Reranking

Aperçu

jina-reranker-v3 est un reranker listwise multilingue de 597M paramètres qui introduit l'interaction « last but not late » (LBNL), un changement de paradigme par rapport au scoring par paires de cross-encodeur. Au lieu d'évaluer chaque paire requête-document de façon isolée, il traite simultanément une liste entière de documents candidats au sein d'une unique fenêtre de contexte de 131K tokens, en utilisant l'attention causale pour capturer les relations inter-documents. Il atteint une performance BEIR de pointe (61,94 NDCG@10) avec 2,5× moins de paramètres que le concurrent le plus proche.

Méthodes

L'innovation centrale est l'architecture LBNL. Dans un cross-encodeur standard, chaque paire requête-document est scorée de manière indépendante. Dans un modèle à late-interaction (ColBERT), les documents sont encodés séparément et appariés token par token. LBNL combine les forces des deux : la requête et tous les documents candidats partagent une unique fenêtre d'attention causale, permettant au modèle de prêter attention d'un document à l'autre et de capturer les signaux de pertinence relative que le scoring par paires rate. Le modèle traite jusqu'à 16 documents par passe avant (un positif et 15 négatifs pendant l'entraînement), chaque document étant tronqué à une longueur fixe. Les embeddings sont extraits du dernier token de chaque document via le Last-Token-Pooling, exploitant le mécanisme d'attention causale pour agréger naturellement l'information du contexte précédent. La fenêtre de contexte de 131K tokens est rendue possible par des encodings positionnels rotatifs avec des fréquences de base ajustées. L'entraînement utilise un curriculum progressif en trois étapes avec une perte multi-objectif combinant InfoNCE, perte dispersive (poids 0,45), perte de double appariement (poids 0,85) et perte de similarité.

Performance

Sur BEIR, le modèle atteint 61,94 NDCG@10, le plus élevé parmi tous les rerankers évalués et une amélioration de 4,88 % par rapport à jina-reranker-v2. Il excelle dans la recherche multi-sauts (78,56 sur HotpotQA) et la vérification de faits (93,95 sur FEVER). Le rendement multilingue atteint 66,50 sur MIRACL sur 18 langues, avec 78,69 en arabe et 81,06 en thaï. La recherche de code atteint 63,28 sur CoIR. Il surpasse le mxbai-rerank-large de 1,5B (61,44) avec 2,5× moins de paramètres et montre une amélioration de 5,43 % face à bge-reranker-v2-m3 de la même échelle. Le rendement est relativement stable à travers les ordonnements de documents : aléatoire (62,54), décroissant (61,94), croissant (61,52) — indiquant un scoring listwise robuste indépendant de l'ordonnancement des candidats.

Conseils

Utilisez le gabarit de prompt structuré avec les rôles système/utilisateur/assistant et des jetons spéciaux pour l'extraction des embeddings. Traitez jusqu'à 64 documents par passage en avant pour les collections dépassant le contexte de 131K. Optimal avec des documents ordonnés aléatoirement ou par pertinence décroissante (la différence de performance est <1 %). Exploitez la capacité d'interaction inter-documents pour les tâches de classement comparatif — la conception listwise du modèle capture les relations entre candidats que le scoring par paires rate. Pour les applications multilingues, le modèle offre un transfert zero-shot solide sur 18 langues. Implémentez le traitement par lots pour les grands volumes de documents, en maintenant les embeddings de requête de manière cohérente entre les lots. Les embeddings de sortie à 256 dimensions soutiennent un calcul de similarité efficace. Idéal pour les tâches de raisonnement multi-sauts et de vérification de faits. Pour la production, utilisez jina-reranker-v3.5 pour une inférence 1,22–1,56× plus rapide via l'attention hybride.

Blogs qui mentionnent ce modèle
août 03, 2026 • 11 minutes lues
jina-reranker-v3.5: Faster Listwise Reranking with Hybrid Attention and Self-Distillation
A 0.6B listwise reranker that beats Qwen3-Reranker-4B on BEIR, reranks up to 1.56x faster than v3, and gains 9.6 nDCG@10 on semi-structured retrieval.
Jina AI
octobre 03, 2025 • 7 minutes lues
Jina Reranker v3: 0.6B Listwise Reranker for SOTA Multilingual Retrieval
New 0.6B-parameter listwise reranker that considers the query and all candidate documents in a single context window.
Jina AI
Light blue background with stylized text in the center, composed of small dots or squares, evoking a modern and minimalistic
janvier 22, 2025 • 10 minutes lues
What Should We Learn From ModernBERT?
Bigger training data, efficient parameter sizing, and a deep-but-thin architecture, ModernBERT sets a direction for future BERT-like models.
Nan Wang
Alex C-G
Futuristic illustration with a central white circle surrounded by white dots on a dotted background.
septembre 18, 2024 • 10 minutes lues
Jina Embeddings v3: A Frontier Multilingual Embedding Model
jina-embeddings-v3 is a frontier multilingual text embedding model with 570M parameters and 8192 token-length, outperforming the latest proprietary embeddings from OpenAI and Cohere on MTEB.
Jina AI
Dynamic image showing the characters "V3" formed by bright green dots varying in size on a black background.
Langue / thème actuel
Search Foundation
Reader
Embeddings
Reclasseur
Obtenir la clé API Jina
Limite de débit
À propos de nous
Actualités
Télécharger le logo Jina
open_in_new
Télécharger le logo Elastic
open_in_new
Statut de l'API
Elastic © 2026.SécuritéTermes et conditionsConfidentialitéGérer les cookiesNe vendez ni ne partagez mes informations personnelles
Ce site web et l'ensemble de son contenu, de ses logiciels, produits et services sont destinés exclusivement à un usage professionnel. Aucun usage à des fins de consommation n'est prévu.