Elastic
Jina AI
Modèles
API
keyboard_arrow_down
Reader
Convertissez n'importe quelle URL en Markdown pour un meilleur grounding des LLM.
Embeddings
Embeddings multimodales et multilingues.
Reclasseur
Outil de reclassement pour optimiser la pertinence des résultats de recherche.
MCP
terminal
CLI
article
llms.txt
smart_toy
Agents
data_object
Schéma
menu_book
Documents
Se connecter
login
Embeddings
Reclasseur
copyright CC BY-NC 4.0
open_in_new Article de lancement

jina-colbert-v2

Le meilleur ColBERT multilingue avec des performances de pointe en matière d'embedding et de reclassement
Licence
copyright CC-BY-NC-4.0
Date de sortie
calendar_month
2024-08-31
Saisie
abc
Texte
arrow_forward
Sortir
apps
Multi-vecteur
Dimensions Matryoshka help_outline
64
96
128
Détails du modèle
Paramètres: 560M
Longueur du token d'entrée: 8K
Dimension de sortie: 128
Modèle de base help_outline
jina-xlm-roberta
Langues enseignées help_outline
89 langues
Langues prises en charge help_outline
108 langues
Modèles associés
link
jina-colbert-v1-en
Disponible via
API Jina
AWS SageMaker
Microsoft Azure
Google Cloud
Hugging Face
Air-gapped
Graphique d'E/S 1

multiple

Vecteur

Requête

jina-colbert-v2

Graphique d'E/S 2

multiple

Vecteur

Document

jina-colbert-v2

Frontière de Paretohelp_outline
BEIR
MIRACL
chevron_leftchevron_right
30M100M300M1B3.0B50556065answerai-colbert-small-…bge-reranker-basebge-reranker-v2-m3ColBERTv2GTE-ModernColBERT-v1jina-reranker-m0jina-reranker-v1-base-enjina-reranker-v1-turbo-…jina-reranker-v2-base-m…jina-reranker-v3jina-reranker-v3.5ms-marco-MiniLM-L-4-v2mxbai-rerank-base-v1mxbai-rerank-base-v2mxbai-rerank-large-v2mxbai-rerank-xsmall-v1Qwen3-Reranker-0.6Bjina-colbert-v2Paramètres (log)nDCG@10
Ce modèle
Sur la frontière
Jina AI
Autres
BEIR
54.49
Paramètres
559M
Rang par score
12 / 21
Frontière de Pareto
Derrière
Distribution des valeurshelp_outline
AUC 0.9726
Corpus
Paires de traduction
Code
19.141518202325
Liées81.0%
Négatif difficile10.3%
Non liées0.8%
Seuils recommandés
FPR 0.1 · 17.83
FPR 0.01 · 19.14
FPR 0.001 · 21.08
FPR 0.0001 · 23.67
équilibré · 18.66
AUC
0.9726
Plafond de bruit
21.05
Décrochage du rappel
16.22
Paires mesurées
100 / 9,200
Score par ranghelp_outline
12345678910
Score moyen à chaque position de rang
Choisissez les modèles à comparer
Publications (1)
EMNLP 2024
août 30, 2024
Jina-ColBERT-v2: A General-Purpose Multilingual Late Interaction Retriever

Aperçu

jina-colbert-v2 est un modèle de recherche late-interaction multilingue de 560M paramètres prenant en charge 89 langues. C'est le premier modèle de type ColBERT multilingue à générer des embeddings de niveau des tokens compacts (64–128 dimensions par token), permettant une recherche multilingue évolutive et économique. L'apprentissage de représentation Matryoshka autorise la réduction de dimension de 128 à 64 avec seulement 1,5 % de baisse de performance, réduisant de moitié les besoins de stockage.

Méthodes

Le modèle s'appuie sur l'architecture late-interaction de ColBERT avec un backbone XLM-RoBERTa modifié (560M paramètres), enrichi d'embeddings de position rotatifs et optimisé avec Flash Attention. L'entraînement implique deux étapes clés : (1) pré-entraînement initial sur des données diversement faiblement supervisées de plusieurs langues, (2) ajustement fin sur des données de triplets étiquetées avec distillation supervisée depuis un modèle enseignant plus grand. L'innovation clé est la mise en œuvre de l'apprentissage de représentation Matryoshka pour les embeddings multi-vecteurs : le modèle produit des vecteurs au niveau des tokens en 128, 96 ou 64 dimensions à partir d'un seul processus d'entraînement, permettant l'optimisation dynamique du stockage sans ré-entraînement. Le contexte de documents de 8 192 tokens (extensible à 12 288) et la limite de requêtes de 32 tokens sont gérés par des encodings positionnels ALiBi.

Performance

Le modèle atteint une amélioration de 6,5 % par rapport au ColBERT-v2 original sur les tâches anglaises, avec un score moyen de 0,521 sur 14 benchmarks BEIR. Il surpasse les méthodes de recherche traditionnelles basées sur BM25 dans toutes les langues testées sur les benchmarks MIRACL, montrant une force particulière dans les scénarios interlinguistiques. Passer de 128 à 64 dimensions ne provoque qu'une baisse de 1,5 % de performance tout en réduisant de moitié les besoins de stockage — par exemple, stocker 100 millions de documents avec des vecteurs de 64 dimensions coûte 659,62 $/mois sur AWS, contre 1 319,24 $ pour 128 dimensions. La couverture multilingue du modèle (89 langues) et ses embeddings de tokens compacts le rendent unique pour les applications de recherche mondiale.

Conseils

Le modèle nécessite du matériel compatible CUDA pour une performance optimale. Il prend en charge des longueurs de documents jusqu'à 8 192 tokens (extensibles à 12 288), tout en limitant les requêtes à 32 tokens. Pour le déploiement en production, il est disponible via la Jina Search Foundation API, le marketplace AWS et Azure, avec une version non commerciale sur Hugging Face. Lors de la mise en œuvre, précisez si vous encodez des requêtes ou des documents — le modèle utilise un encodage asymétrique. Le modèle n'est pas conçu pour le traitement en temps réel de collections de documents extrêmement grandes sans indexation appropriée ; utilisez FAISS, Qdrant ou Weaviate pour la recherche ANN. Pour les tâches spécifiques à un domaine, envisagez l'ajustement fin sur votre corpus. Pour la recherche à vecteur unique avec une sortie plus dimensionnelle, envisagez jina-embeddings-v4 (mode multi-vecteur) ou jina-embeddings-v5-text-small.

Blogs qui mentionnent ce modèle
octobre 03, 2025 • 7 minutes lues
Jina Reranker v3: 0.6B Listwise Reranker for SOTA Multilingual Retrieval
New 0.6B-parameter listwise reranker that considers the query and all candidate documents in a single context window.
Jina AI
Light blue background with stylized text in the center, composed of small dots or squares, evoking a modern and minimalistic
décembre 16, 2024 • 2 minutes lues
Re·Search: Order 2024 Yearbook of Search Foundation Advances
Discover Re·Search, our premium yearbook showcasing our best research articles and search foundation models in 2024. Featuring spot UV-coated hardcover, 160 full-color pages, and meticulous design throughout. Available worldwide at $35, shipping included.
Jina AI
Open red publication "ReSearch" volume 24 displayed on a white surface with a distinctive shadow casting over the pages.
octobre 29, 2024 • 11 minutes lues
Beyond CLIP: How Jina-CLIP Advances Multimodal Search
Learn how Jina-CLIP enhances OpenAI's CLIP with better retrieval accuracy and more diverse results through unified text-image embeddings.
Bo Wang
Alex C-G
Abstract digital landscape with wave-like green and pink dunes against a dark background, conveying a tranquil atmosphere.
août 30, 2024 • 10 minutes lues
Jina ColBERT v2: Multilingual Late Interaction Retriever for Embedding and Reranking
Jina ColBERT v2 supports 89 languages with superior retrieval performance, user-controlled output dimensions, and 8192 token-length.
Jina AI
Dark-themed coding interface displaying English and Japanese characters with "JINA COLBERT V2" highlighted in the center.
février 20, 2024 • 16 minutes lues
What is ColBERT and Late Interaction and Why They Matter in Search?
Jina AI's ColBERT on Hugging Face has set Twitter abuzz, bringing a fresh perspective to search with its 8192-token capability. This article unpacks the nuances of ColBERT and ColBERTv2, showcasing their innovative designs and why their late interaction feature is a game-changer for search.
Han Xiao
Neon theater or concert hall marquee letters lit up at night with city lights and faint "Adobe Sto" visible.
Langue / thème actuel
Search Foundation
Reader
Embeddings
Reclasseur
Obtenir la clé API Jina
Limite de débit
À propos de nous
Actualités
Télécharger le logo Jina
open_in_new
Télécharger le logo Elastic
open_in_new
Statut de l'API
Elastic © 2026.SécuritéTermes et conditionsConfidentialitéGérer les cookiesNe vendez ni ne partagez mes informations personnelles
Ce site web et l'ensemble de son contenu, de ses logiciels, produits et services sont destinés exclusivement à un usage professionnel. Aucun usage à des fins de consommation n'est prévu.