Graphique d'E/S

multiple

Document

Requête

jina-reranker-v3

Classement

Frontière de Pareto
300M1B3.0B10B4050607080bge-m3 (multi-vector)bge-reranker-v2-gemmabge-reranker-v2-m3bge-reranker-v2.5-gemma…ColBERT-ZeroGTE-ModernColBERT-v1jina-colbert-v2jina-reranker-m0jina-reranker-v2-base-m…jina-reranker-v3.5LFM2.5-ColBERT-350Mmxbai-rerank-base-v2mxbai-rerank-large-v2PLAID-XQwen3-Reranker-0.6BQwen3-Reranker-4Bjina-reranker-v3Paramètres (log)nDCG@10
Ce modèle
Sur la frontière
Jina AI
Autres
MIRACL
72.20
Paramètres
597M
Rang par score
5 / 17
Frontière de Pareto
Derrière
Distribution des valeurs
AUC 0.8396
Corpus
Paires de traduction
Recherche documentaire
Code
0.020-0.200.000.200.400.60
Liées62.2%
Négatif difficile18.2%
Non liées9.5%
Seuils recommandés
FPR 0.1 · 0.020
FPR 0.01 · 0.238
FPR 0.001 · 0.424
FPR 0.0001 · 0.600
équilibré · -0.008
AUC
0.8396
Plafond de bruit
0.414
Décrochage du rappel
-0.185
Paires mesurées
119 / 2 856
Score par rang
12345678910
Score moyen à chaque position de rang
Ce qui gagne le rang 1
Une correspondance correcte gagne 45 % des 119 requêtes
Sensibilité au pool
Position dans la liste0.161
Taille du pool0.088
Difficulté du remplissage0.015
Plus grand écart de score sur une même paire
Choisissez les modèles à comparer
Publications (1)

Aperçu

jina-reranker-v3 est un reranker listwise multilingue de 597M paramètres qui introduit l'interaction « last but not late » (LBNL), un changement de paradigme par rapport au scoring par paires de cross-encodeur. Au lieu d'évaluer chaque paire requête-document de façon isolée, il traite simultanément une liste entière de documents candidats au sein d'une unique fenêtre de contexte de 131K tokens, en utilisant l'attention causale pour capturer les relations inter-documents. Il atteint une performance BEIR de pointe (61,94 NDCG{'@'}10) avec 2,5× moins de paramètres que le concurrent le plus proche.

Méthodes

L'innovation centrale est l'architecture LBNL. Dans un cross-encodeur standard, chaque paire requête-document est scorée de manière indépendante. Dans un modèle à late-interaction (ColBERT), les documents sont encodés séparément et appariés token par token. LBNL combine les forces des deux : la requête et tous les documents candidats partagent une unique fenêtre d'attention causale, permettant au modèle de prêter attention d'un document à l'autre et de capturer les signaux de pertinence relative que le scoring par paires rate. Le modèle traite jusqu'à 16 documents par passe avant (un positif et 15 négatifs pendant l'entraînement), chaque document étant tronqué à une longueur fixe. Les embeddings sont extraits du dernier token de chaque document via le Last-Token-Pooling, exploitant le mécanisme d'attention causale pour agréger naturellement l'information du contexte précédent. La fenêtre de contexte de 131K tokens est rendue possible par des encodings positionnels rotatifs avec des fréquences de base ajustées. L'entraînement utilise un curriculum progressif en trois étapes avec une perte multi-objectif combinant InfoNCE, perte dispersive (poids 0,45), perte de double appariement (poids 0,85) et perte de similarité.

Performance

Sur BEIR, le modèle atteint 61,94 NDCG{'@'}10, le plus élevé parmi tous les rerankers évalués et une amélioration de 4,88 % par rapport à jina-reranker-v2. Il excelle dans la recherche multi-sauts (78,56 sur HotpotQA) et la vérification de faits (93,95 sur FEVER). Le rendement multilingue atteint 66,50 sur MIRACL sur 18 langues, avec 78,69 en arabe et 81,06 en thaï. La recherche de code atteint 63,28 sur CoIR. Il surpasse le mxbai-rerank-large de 1,5B (61,44) avec 2,5× moins de paramètres et montre une amélioration de 5,43 % face à bge-reranker-v2-m3 de la même échelle. Le rendement est relativement stable à travers les ordonnements de documents : aléatoire (62,54), décroissant (61,94), croissant (61,52) — indiquant un scoring listwise robuste indépendant de l'ordonnancement des candidats.

Conseils

Utilisez le gabarit de prompt structuré avec les rôles système/utilisateur/assistant et des jetons spéciaux pour l'extraction des embeddings. Traitez jusqu'à 64 documents par passage en avant pour les collections dépassant le contexte de 131K. Optimal avec des documents ordonnés aléatoirement ou par pertinence décroissante (la différence de performance est <1 %). Exploitez la capacité d'interaction inter-documents pour les tâches de classement comparatif — la conception listwise du modèle capture les relations entre candidats que le scoring par paires rate. Pour les applications multilingues, le modèle offre un transfert zero-shot solide sur 18 langues. Implémentez le traitement par lots pour les grands volumes de documents, en maintenant les embeddings de requête de manière cohérente entre les lots. Les embeddings de sortie à 256 dimensions soutiennent un calcul de similarité efficace. Idéal pour les tâches de raisonnement multi-sauts et de vérification de faits. Pour la production, utilisez jina-reranker-v3.5 pour une inférence 1,22–1,56× plus rapide via l'attention hybride.

Blogs qui mentionnent ce modèle