Elastic
Jina AI
Modèles
API
keyboard_arrow_down
Lecteur
Lisez les URL et effectuez des recherches sur le Web pour de meilleurs LLM de base.
Intégrations
Intégrations multimodales et multilingues.
Reclasseur
Outil de reclassement pour optimiser la pertinence des résultats de recherche.
Elastic Inference Service
Exécutez les modèles Jina nativement au sein d'Elasticsearch.
MCP
terminal
CLI
article
llms.txt
smart_toy
Agents
data_object
Schéma
menu_book
Documents
Se connecter
login
Reclasseur
copyright CC BY-NC 4.0
open_in_new Publication de publication

jina-reranker-v3

Listwise reranker pour la recherche de documents multilingues SOTA
Licence
copyright CC-BY-NC-4.0
Date de sortie
calendar_month
2025-10-01
Saisir
abc
Texte (requête)
abc
Texte (Document)
arrow_forward
Sortir
format_list_numbered
Classements
Détails du modèle
Paramètres: 597M
Longueur du jeton d'entrée: 131K
Dimension de sortie: 256
Modèle de base help_outline
open_in_new
Qwen3-0.6B
Langues enseignées help_outline
24 langues
Langues prises en charge help_outline
93 langues
Quantifications help_outline
GGUF
Prise en charge d'Apple Silicon help_outline
MLX
Modèles associés
link
jina-reranker-v3.5
link
jina-reranker-v2-base-multilingual
link
jina-reranker-m0
Disponible via
Elastic Inference Service
API Jina
AWS SageMaker
Microsoft Azure
Google Cloud
Hugging Face
Air-gapped
Graphique d'E/S

multiple

Document

Requête

jina-reranker-v3

Classement

Pareto fronthelp_outline
BEIR
MIRACL
chevron_leftchevron_right
30M100M300M1B3.0B50556065answerai-colbert-small-…bge-reranker-basebge-reranker-v2-m3ColBERTv2GTE-ModernColBERT-v1jina-colbert-v2jina-reranker-m0jina-reranker-v1-base-enjina-reranker-v1-turbo-…jina-reranker-v2-base-m…jina-reranker-v3.5ms-marco-MiniLM-L-4-v2mxbai-rerank-base-v1mxbai-rerank-base-v2mxbai-rerank-large-v2mxbai-rerank-xsmall-v1Qwen3-Reranker-0.6Bjina-reranker-v3Parameters (log)nDCG@10
This model
On the front
Jina AI
Other
BEIR
62.10
Parameters
597M
Rank by score
4 / 21
Pareto front
Behind it
Distribution des valeurshelp_outline
AUC 0.8396
Corpus
Paires de traduction
Recherche documentaire
Code
0.020-0.200.000.200.400.60
Liées62.2%
Négatif difficile18.2%
Non liées9.5%
Seuils recommandés
FPR 0.1 · 0.020
FPR 0.01 · 0.238
FPR 0.001 · 0.424
FPR 0.0001 · 0.600
équilibré · -0.008
AUC
0.8396
Plafond de bruit
0.414
Décrochage du rappel
-0.185
Paires mesurées
119 / 2,856
Score par ranghelp_outline
12345678910
Score moyen à chaque position de rang
Ce qui gagne le rang 1help_outline
Une correspondance correcte gagne 45 % des 119 requêtes
Sensibilité au poolhelp_outline
Position dans la liste0.161
Taille du pool0.088
Difficulté du remplissage0.015
Plus grand écart de score sur une même paire
Choisissez les modèles à comparer
Publications (1)
AAAI 2026
octobre 01, 2025
jina-reranker-v3: Last but Not Late Interaction for Document Reranking

Aperçu

jina-reranker-v3 est un reranker de documents multilingue de 0,6 milliard de paramètres, qui introduit une nouvelle architecture d'interaction « last but not late ». Contrairement à l'encodage séparé avec correspondance multi-vecteurs de ColBERT, ce modèle effectue une auto-attention causale entre la requête et les documents au sein de la même fenêtre contextuelle, permettant ainsi des interactions inter-documents riches avant d'extraire les embeddings contextuels du dernier token de chaque document. Basé sur Qwen3-0.6B avec 28 couches de transformeur et un projecteur MLP léger (1024→512→256), il traite jusqu'à 64 documents simultanément dans un contexte de 131K tokens. Le modèle atteint des performances BEIR de pointe avec 61,94 nDCG-10, tout en étant 10 fois plus compact que les rerankers génératifs listwise.

Méthodes

L'apprentissage progressif en trois étapes avec perte multi-objectif combine InfoNCE, perte dispersive (0,45), perte de double appariement (0,85) et perte de similarité (0,85). L'étape 1 utilise un réglage fin LoRA (r = 16, α = 32) sur des jeux de données spécifiques à un domaine, notamment BGE-M3 et Cornstack, avec 16 documents par requête. L'étape 2 étend le contexte à 8 192 tokens et extrait des négatifs difficiles (hard negatives) issus de plusieurs systèmes de recherche, jusqu'à 25 négatifs à τ = 0,05. L'étape 3 fusionne des modèles spécialisés avec des pondérations de 0,25 à 0,65. Les tokens spéciaux doc_emb et query_emb marquent les positions d'extraction des embeddings. L'apprentissage utilise des prompts structurés avec des rôles système/utilisateur/assistant, plaçant la requête au début et à la fin pour une attention bidirectionnelle.

Performance

Atteint 61,94 nDCG-10 sur BEIR, le plus élevé parmi tous les rerankers évalués et une amélioration de 4,88 % par rapport à jina-reranker-v2. Excellent en récupération multi-sauts avec 78,56 sur HotpotQA, la vérification des faits atteignant 93,95 sur FEVER. Les performances multilingues atteignent 66,50 sur MIRACL sur 18 langues, avec l'arabe à 78,69 et le thaï à 81,06. La récupération de code atteint 63,28 sur CoIR. Surpasse 1,5B mxbai-rerank-large (61,44) avec 2,5 fois moins de paramètres. Affiche une amélioration de 5,43 % par rapport à bge-reranker-v2-m3 de même échelle. Relativement stable dans tous les ordres de documents : aléatoire (62,54), décroissant (61,94), croissant (61,52).

Conseils

Utilisez un modèle de prompt structuré avec des rôles système/utilisateur/assistant et des tokens spéciaux pour l'extraction des embeddings. Traitez jusqu'à 64 documents par passe avant pour les collections dépassant le contexte de 131K. Optimal avec des documents classés aléatoirement ou par ordre de pertinence décroissante. Exploitez la capacité d'interaction entre documents pour les tâches de classement comparatif. Pour les applications multilingues, le modèle offre un solide transfert zero-shot dans 18 langues. Mettez en œuvre le traitement par lots pour les grands ensembles de documents, en conservant la cohérence des embeddings de requêtes entre les lots. Envisagez les embeddings de sortie à 256 dimensions pour un calcul de similarité efficace. Idéal pour les applications exigeant à la fois qualité de classement et efficacité d'inférence, notamment le raisonnement multi-sauts et les tâches de vérification des faits.
Blogs qui mentionnent ce modèle
août 03, 2026 • 11 minutes lues
jina-reranker-v3.5: Faster Listwise Reranking with Hybrid Attention and Self-Distillation
A 0.6B listwise reranker that beats Qwen3-Reranker-4B on BEIR, reranks up to 1.56x faster than v3, and gains 9.6 nDCG@10 on semi-structured retrieval.
Jina AI
octobre 03, 2025 • 7 minutes lues
Jina Reranker v3: 0.6B Listwise Reranker for SOTA Multilingual Retrieval
New 0.6B-parameter listwise reranker that considers the query and all candidate documents in a single context window.
Jina AI
Light blue background with stylized text in the center, composed of small dots or squares, evoking a modern and minimalistic
janvier 22, 2025 • 10 minutes lues
What Should We Learn From ModernBERT?
Bigger training data, efficient parameter sizing, and a deep-but-thin architecture, ModernBERT sets a direction for future BERT-like models.
Nan Wang
Alex C-G
Futuristic illustration with a central white circle surrounded by white dots on a dotted background.
septembre 18, 2024 • 10 minutes lues
Jina Embeddings v3: A Frontier Multilingual Embedding Model
jina-embeddings-v3 is a frontier multilingual text embedding model with 570M parameters and 8192 token-length, outperforming the latest proprietary embeddings from OpenAI and Cohere on MTEB.
Jina AI
Dynamic image showing the characters "V3" formed by bright green dots varying in size on a black background.
Langue / thème actuel
Search Foundation
Lecteur
Intégrations
Reclasseur
Obtenir la clé API Jina
Limite de taux
À propos de nous
Nouvelles
Télécharger le logo Jina
open_in_new
Télécharger le logo Elastic
open_in_new
Statut de l'API
Elastic © 2026.Sécuritétermes et conditionsConfidentialitéGérer les cookiesNe vendez ni ne partagez mes informations personnelles
Ce site web et l'ensemble de son contenu, logiciels, produits et services sont destinés exclusivement à un usage professionnel. Leur utilisation par les consommateurs n'est ni prévue ni autorisée.