Aperçu
jina-reranker-v2-base-multilingual est un reranker cross-encodeur de 278M paramètres supportant 100+ langues avec une fenêtre de contexte de 1 024 tokens (524 288 tokens avec Flash Attention 2). C'était le premier reranker de Jina à briser la limitation anglais uniquement, offrant un rendement de pointe sur AirBench et de bons résultats sur les tâches de données structurées, y compris l'appel de fonctions et l'appariement de schémas SQL. Il traite les documents 15× plus vite que les modèles comparables.
Méthodes
Le modèle emploie une architecture cross-encodeur renforcée par Flash Attention 2, permettant une comparaison directe entre requêtes et documents à travers les barrières linguistiques. L'encodeur basé sur BERT de 278M paramètres utilise une attention bidirectionnelle symétrique avec des encodings positionnels ALiBi pour le contexte de base de 1 024 tokens (extensible à 524 288 tokens avec Flash Attention 2). L'entraînement a suivi un processus progressif en quatre étapes : (1) capacités de la langue anglaise, (2) alignement interlingue, (3) incorporation de données multilingues, (4) raffinement par négatifs difficiles. Cette approche par étapes a empêché l'oubli catastrophique qui se produit souvent lorsque des données multilingues sont ajoutées à un modèle monolingue. L'implémentation de Flash Attention 2 est une innovation d'efficacité clé, permettant un débit 15× supérieur à bge-reranker-v2-m3.
Performance
Le modèle atteint un rendement de pointe sur le leaderboard AirBench pour les systèmes RAG et de bons résultats sur MKQA (26 langues). Il excelle dans les tâches de données structurées : rappel élevé sur ToolBench (appel de fonctions) et NSText2SQL (appariement de schémas SQL). Surtout, il traite les documents 15× plus vite que des modèles comparables comme bge-reranker-v2-m3, le rendant pratique pour les applications en temps réel. Le support de 100+ langues et les capacités de données structurées le rendent particulièrement adapté aux systèmes RAG agentiques et à la recherche de documentation d'API multilingue. En 2026, jina-reranker-v3.5 remplace ce modèle avec l'interaction listwise, un contexte de 131K et un entraînement de domaine spécifique.
Conseils
Le modèle requiert une GPU compatible CUDA et est accessible via l'API Reranker de Jina, les principaux frameworks RAG (Haystack, LangChain) et les marketplaces cloud (AWS, Azure, GCP). Il excelle dans les scénarios exigeant une compréhension précise à travers les barrières linguistiques et les types de données : entreprises mondiales travaillant avec du contenu multilingue, recherche de documentation d'API et récupération de code à travers des bases de code multilingues. Avec la fenêtre de contexte de 1 024 tokens et le découpage automatique pour les documents plus longs, il traite le contenu étendu efficacement. Utilisez ce modèle lorsque vous devez améliorer la précision de la recherche entre les langues, que vous avez besoin de capacités d'appel de fonctions pour le RAG agentique, ou que vous souhaitez améliorer la recherche de code à travers des bases de code multilingues. Pour les nouveaux projets, jina-reranker-v3.5 offre le classement listwise, un contexte de 131K et des améliorations de domaine spécifique.









