Elastic
Jina AI
Modèles
API
keyboard_arrow_down
Reader
Convertissez n'importe quelle URL en Markdown pour un meilleur grounding des LLM.
Embeddings
Embeddings multimodales et multilingues.
Reclasseur
Outil de reclassement pour optimiser la pertinence des résultats de recherche.
MCP
terminal
CLI
article
llms.txt
smart_toy
Agents
data_object
Schéma
menu_book
Documents
Se connecter
login
warning
Ce modèle est obsolète pour les modèles plus récents.
Reclasseur
Licence Apache 2.0
open_in_new Article de lancement

jina-reranker-v1-base-en

Notre premier modèle de reranker maximisant la pertinence de la recherche et du RAG
Licence
Apache-2.0
Date de sortie
calendar_month
2024-02-29
Saisie
abc
Texte (requête)
abc
Texte (Document)
arrow_forward
Sortir
format_list_numbered
Classements
Détails du modèle
Paramètres: 137M
Longueur du token d'entrée: 8K
Modèle de base help_outline
link
jina-embeddings-v2-base-en
Langues enseignées help_outline
1 langues
Modèles associés
link
jina-reranker-v1-turbo-en
link
jina-reranker-v1-tiny-en
Disponible via
API Jina
AWS SageMaker
Microsoft Azure
Hugging Face
Air-gapped
Graphique d'E/S

multiple

Document

Requête

jina-reranker-v1

Classement

Frontière de Paretohelp_outline
BEIR
LoCo
BEIR · arguana
LlamaIndex RAG · avg3emb
LlamaIndex RAG · avg3emb · MRR
chevron_leftchevron_right
30M100M7075808590ColBERTv2gte-reranker-modernbert…jina-colbert-v1-enjina-reranker-v1-tiny-enjina-reranker-v1-turbo-…jina-reranker-v1-base-enParamètres (log)nDCG@10
Ce modèle
Sur la frontière
Jina AI
Autres
LoCo
87.31
Paramètres
137M
Rang par score
2 / 6
Frontière de Pareto
Sur elle
Distribution des valeurshelp_outline
AUC 0.9853
Corpus
Paires de traduction
0.4810.000.200.400.600.801.00
Liées85.0%
Négatif difficile6.3%
Non liées1.1%
Seuils recommandés
FPR 0.1 · 0.208
FPR 0.01 · 0.481
FPR 0.001 · 0.697
FPR 0.0001 · 0.978
équilibré · 0.340
AUC
0.9853
Plafond de bruit
0.691
Décrochage du rappel
0.088
Paires mesurées
100 / 9,200
Score par ranghelp_outline
12345678910
Score moyen à chaque position de rang
Choisissez les modèles à comparer

Aperçu

jina-reranker-v1-base-en est un reranker cross-encodeur anglais de 137M paramètres qui affine les résultats de recherche en effectuant une analyse au niveau des tokens des paires requête-document. Il apporte une amélioration de 20 % de la précision de recherche par rapport à la recherche vectorielle de référence, en faisant le cheval de bataille de la première génération de rerankers de Jina. Il est désormais remplacé par les familles multilingues v2 et listwise v3.

Méthodes

Le modèle emploie une architecture de cross-attention basée sur BERT (12 couches, 12 têtes d'attention, 768 dimensions cachées, 137M paramètres) qui diffère fondamentalement des approches basées sur les embeddings. Au lieu de comparer des embeddings de documents précalculés, il effectue des interactions dynamiques au niveau des tokens entre la requête et le document, capturant les nuances contextuelles que la similarité cosinus manque. La fenêtre de contexte de 1 024 tokens prend en charge le découpage automatique et le max-pooling à travers les segments pour les documents plus longs. L'entraînement a utilisé une perte contrastive sur des paires de pertinence requête-document avec minage de négatifs difficiles. Le modèle était le premier reranker de Jina et a établi le modèle pour les variantes turbo et tiny par distillation de connaissances.

Performance

Le modèle atteint 8 % de taux de rappel supplémentaires et une amélioration de 33 % du rang réciproque moyen par rapport à la recherche vectorielle de référence. Sur BEIR, il obtient un NDCG@10 moyen de 0,5588, dépassant BGE (0,5032), BCE (0,4969) et Cohere (0,5141). Sur le benchmark LoCo pour la compréhension de contexte long, il marque 0,873, nettement en avance sur la concurrence. Il montre une force particulière sur le contenu technique : 0,996 sur les abstracts QASPER et 0,962 sur l'analyse de rapports gouvernementaux, bien que le rendement soit moindre (0,466) sur les tâches de résumés de réunions. La latence évolue avec la longueur du document : 156 ms pour 256 tokens, 7 068 ms pour 4 096 tokens avec une requête de 512 tokens.

Conseils

Mettez en place un pipeline en deux étapes : la recherche vectorielle (p. ex. jina-embeddings-v5-text-small) fournit les candidats initiaux, puis ce modèle re-classe les 100–200 premiers pour la précision. Le modèle est uniquement anglais — pour les applications multilingues, utilisez jina-reranker-v2-base-multilingual ou jina-reranker-v3.5. Il exige du matériel compatible CUDA pour le débit de production. Pour les nouveaux projets, préférez jina-reranker-v3.5 (multilingue, listwise, contexte 131K, 63,20 BEIR NDCG@10). Le modèle est disponible via l'API Reranker de Jina, AWS SageMaker et Hugging Face. Lors de l'intégration avec des systèmes RAG, ajustez le nombre de documents envoyés pour le re-classement selon les besoins de latence — 100–200 documents équilibrent généralement qualité et vitesse.

Blogs qui mentionnent ce modèle
juin 25, 2024 • 15 minutes lues
Jina Reranker v2 for Agentic RAG: Ultra-Fast, Multilingual, Function-Calling & Code Search
Jina Reranker v2 is the best-in-class reranker built for Agentic RAG. It features function-calling support, multilingual retrieval for over 100 languages, code search capabilities, and offers a 6x speedup over v1.
Saahil Ognawala
Jie Fu
Yuting Zhang
Scott Martens
Black background with word 'RERANKER' in white at left and a stylized white question mark design at the right.
juin 03, 2024 • 6 minutes lues
Implementing a Chat History RAG with Jina AI and Milvus Lite
Enhance your search applications in Python with Jina Embeddings and Reranker and lightweight, easy-to-deploy Milvus Lite.
Francesco Kruk
Saahil Ognawala
Black background with vivid geometric shapes on the sides and central logos "Embeddings," "Reranker," and "Milvus."
mai 13, 2024 • 5 minutes lues
Albus by Springworks: Empowering Employees with Enterprise Search
Learn how a leading HR-tech startup uses Jina AI’s models to talk with structured and unstructured data.
Francesco Kruk
Saahil Ognawala
Albus logo in white on a dark blue background, surrounded by abstract blue shapes and symbols.
mai 07, 2024 • 12 minutes lues
When AI Makes AI: Synthetic Data, Model Distillation, And Model Collapse
AI creating AI! Is it the end of the world? Or just another tool to make models do value-adding work? Let’s find out!
Scott Martens
Abstract depiction of a brain in purple and pink hues with a fluid, futuristic design against a blue and purple background.
avril 29, 2024 • 7 minutes lues
Jina Embeddings and Reranker on Azure: Scalable Business-Ready AI Solutions
Jina Embeddings and Rerankers are now available on Azure Marketplace. Enterprises that prioritize privacy and security can now easily integrate Jina AI's state-of-the-art models right in their existing Azure ecosystem.
Susana Guzmán
Futuristic black background with a purple 3D grid, featuring the "Embeddings" and "Reranker" logos with a stylized "A".
Langue / thème actuel
Search Foundation
Reader
Embeddings
Reclasseur
Obtenir la clé API Jina
Limite de débit
À propos de nous
Actualités
Télécharger le logo Jina
open_in_new
Télécharger le logo Elastic
open_in_new
Statut de l'API
Elastic © 2026.SécuritéTermes et conditionsConfidentialitéGérer les cookiesNe vendez ni ne partagez mes informations personnelles
Ce site web et l'ensemble de son contenu, de ses logiciels, produits et services sont destinés exclusivement à un usage professionnel. Aucun usage à des fins de consommation n'est prévu.