Elastic
Jina AI
Modèles
API
keyboard_arrow_down
Lecteur
Lisez les URL et effectuez des recherches sur le Web pour de meilleurs LLM de base.
Intégrations
Intégrations multimodales et multilingues.
Reclasseur
Outil de reclassement pour optimiser la pertinence des résultats de recherche.
Elastic Inference Service
Exécutez les modèles Jina nativement au sein d'Elasticsearch.
MCP
terminal
CLI
article
llms.txt
smart_toy
Agents
data_object
Schéma
menu_book
Documents
Se connecter
login
warning
Ce modèle est obsolète pour les modèles plus récents.
Reclasseur
copyright CC BY-NC 4.0
open_in_new Publication de publication

jina-reranker-v2-base-multilingual

Réorganisateur d'encodeurs croisés avec prise en charge multilingue, appels de fonctions et recherche de code.
Licence
copyright CC-BY-NC-4.0
Date de sortie
calendar_month
2024-06-25
Saisir
abc
Texte (requête)
abc
Texte (Document)
arrow_forward
Sortir
format_list_numbered
Classements
Détails du modèle
Paramètres: 278M
Longueur du jeton d'entrée: 1K
Modèle de base help_outline
open_in_new
XLM-RoBERTa Base
Langues enseignées help_outline
24 langues
Langues prises en charge help_outline
108 langues
Modèles associés
link
jina-reranker-v1-base-en
link
jina-reranker-v1-turbo-en
link
jina-reranker-v1-tiny-en
Disponible via
Elastic Inference Service
API Jina
AWS SageMaker
Microsoft Azure
Google Cloud
Hugging Face
Air-gapped
Graphique d'E/S

multiple

Document

Requête

jina-reranker-v2-base-multilingual

Classement

Pareto fronthelp_outline
BEIR
MIRACL
chevron_leftchevron_right
30M100M300M1B3.0B50556065answerai-colbert-small-…bge-reranker-basebge-reranker-v2-m3ColBERTv2GTE-ModernColBERT-v1jina-colbert-v2jina-reranker-m0jina-reranker-v1-base-enjina-reranker-v1-turbo-…jina-reranker-v3jina-reranker-v3.5ms-marco-MiniLM-L-4-v2mxbai-rerank-base-v1mxbai-rerank-base-v2mxbai-rerank-large-v2mxbai-rerank-xsmall-v1Qwen3-Reranker-0.6Bjina-reranker-v2-base-m…Parameters (log)nDCG@10
This model
On the front
Jina AI
Other
BEIR
57.06
Parameters
278M
Rank by score
7 / 21
Pareto front
On it
Distribution des valeurshelp_outline
AUC 0.8574
Corpus
Paires de traduction
Recherche documentaire
Code
0.3670.200.400.600.80
Liées63.0%
Négatif difficile19.0%
Non liées9.9%
Seuils recommandés
FPR 0.1 · 0.367
FPR 0.01 · 0.683
FPR 0.001 · 0.839
FPR 0.0001 · 0.862
équilibré · 0.270
AUC
0.8574
Plafond de bruit
0.832
Décrochage du rappel
0.061
Paires mesurées
119 / 2,856
Score par ranghelp_outline
12345678910
Score moyen à chaque position de rang
Ce qui gagne le rang 1help_outline
Une correspondance correcte gagne 50 % des 119 requêtes
Choisissez les modèles à comparer

Aperçu

Jina Reranker v2 Base Multilingual est un modèle de codeur croisé conçu pour améliorer la précision de la recherche au-delà des barrières linguistiques et des types de données. Ce reranker relève le défi crucial de la récupération précise d'informations dans des environnements multilingues, particulièrement utile pour les entreprises mondiales qui doivent affiner les résultats de recherche dans différentes langues et types de contenu. Avec la prise en charge de plus de 100 langues et des capacités uniques en matière d'appel de fonctions et de recherche de code, il constitue une solution unifiée pour les équipes qui ont besoin d'affiner la recherche avec précision dans le contenu international, la documentation API et les bases de code multilingues. La conception compacte de 278 millions de paramètres du modèle le rend particulièrement attrayant pour les organisations qui cherchent à équilibrer hautes performances et efficacité des ressources.

Méthodes

Ce modèle utilise une architecture d'encodage croisé optimisée par Flash Attention 2, permettant une comparaison directe entre les requêtes et les documents pour une évaluation de pertinence plus précise. Entraîné en quatre étapes, il acquiert d'abord des compétences en anglais, puis intègre progressivement des données interlingues et multilingues, avant d'être affiné par des exemples négatifs stricts. Cette approche d'entraînement innovante, combinée à l'implémentation de Flash Attention 2, permet au modèle de gérer un contexte allant jusqu'à 1024 tokens, avec une segmentation automatique pour les documents plus longs. L'efficacité de cette architecture lui permet de gérer des tâches complexes de réordonnancement multilingues avec un débit six fois supérieur à celui de son prédécesseur, tout en garantissant une évaluation de pertinence précise grâce à l'interaction directe entre les requêtes et les documents.

Performance

Lors d'évaluations en conditions réelles, le modèle démontre des capacités exceptionnelles dans divers tests de performance. Il atteint des performances de pointe dans le classement AirBench pour les systèmes RAG et affiche de bons résultats dans les tâches multilingues, notamment dans l'ensemble de données MKQA couvrant 26 langues. Le modèle excelle particulièrement dans les tâches de données structurées, obtenant des scores de rappel élevés à la fois dans l'appel de fonctions (test de performance ToolBench) et dans la correspondance de schémas SQL (test de performance NSText2SQL). Plus impressionnant encore, il fournit ces résultats tout en traitant les documents 15 fois plus rapidement que des modèles comparables comme bge-reranker-v2-m3, ce qui le rend pratique pour les applications en temps réel. Cependant, les utilisateurs doivent noter que des performances optimales nécessitent un GPU compatible CUDA pour l'inférence.

Conseils

Pour un déploiement optimal, le modèle requiert un GPU compatible CUDA et est accessible via plusieurs canaux, notamment l'API Reranker, les principaux frameworks RAG tels que Haystack et LangChain, ou déployable en mode privé via des plateformes cloud. Ce modèle excelle dans les scénarios exigeant une compréhension précise malgré les barrières linguistiques et les types de données, ce qui le rend idéal pour les entreprises internationales travaillant avec du contenu multilingue, de la documentation API ou des dépôts de code. Grâce à une fenêtre de contexte de 1024 jetons et au découpage automatique en segments pour les documents longs, le modèle gère efficacement les contenus étendus. Les équipes devraient envisager l'utilisation de ce modèle lorsqu'elles souhaitent améliorer la précision de la recherche multilingue, ont besoin de capacités d'appel de fonctions pour les systèmes RAG multilingues ou veulent optimiser la recherche de code dans des bases de code multilingues. Le modèle est particulièrement efficace lorsqu'il est utilisé conjointement avec des systèmes de recherche vectorielle, où il peut améliorer significativement le classement final des documents extraits.
Blogs qui mentionnent ce modèle
octobre 03, 2025 • 7 minutes lues
Jina Reranker v3: 0.6B Listwise Reranker for SOTA Multilingual Retrieval
New 0.6B-parameter listwise reranker that considers the query and all candidate documents in a single context window.
Jina AI
Light blue background with stylized text in the center, composed of small dots or squares, evoking a modern and minimalistic
avril 16, 2025 • 10 minutes lues
On the Size Bias of Text Embeddings and Its Impact in Search
Size bias refers to how the length of text inputs affects similarity, regardless of semantic relevance. It explains why search systems sometimes return long, barely-relevant documents instead of shorter, more precise matches to your query.
Scott Martens
Black background with a simple white ruler marked in centimeters, emphasizing a minimalist design.
avril 08, 2025 • 21 minutes lues
jina-reranker-m0: Multilingual Multimodal Document Reranker
Introducing jina-reranker-m0, our new multilingual multimodal reranker for retrieving visual documents, with SOTA performance on multilingual long documents and code searching tasks.
Jina AI
Modern dot matrix text display on a dark blue background, conveying a digital feel.
avril 01, 2025 • 17 minutes lues
Using DeepSeek R1 Reasoning Model in DeepSearch
Standard LLM or reasoning model, which is better for DeepSearch? In this post, we explored using DeepSeek-R1 in the DeepSearch implementation for choosing the next action.
Andrei Ungureanu
Alex C-G
Brown background with a stylized whale graphic and the text "THINK:" and ":SEARCH>" in code-like font.
mars 12, 2025 • 11 minutes lues
Snippet Selection and URL Ranking in DeepSearch/DeepResearch
Nailing these two details takes your DeepSearch from mid to GOAT: selecting the best snippets from lengthy webpages and ranking URLs before crawling.
Han Xiao
Logo with words "THINK SEARCH THINK" in black dot and arrow patterns on an orange background, accompanied by horizontal lines
Langue / thème actuel
Search Foundation
Lecteur
Intégrations
Reclasseur
Obtenir la clé API Jina
Limite de taux
À propos de nous
Nouvelles
Télécharger le logo Jina
open_in_new
Télécharger le logo Elastic
open_in_new
Statut de l'API
Elastic © 2026.Sécuritétermes et conditionsConfidentialitéGérer les cookiesNe vendez ni ne partagez mes informations personnelles
Ce site web et l'ensemble de son contenu, logiciels, produits et services sont destinés exclusivement à un usage professionnel. Leur utilisation par les consommateurs n'est ni prévue ni autorisée.