Elastic
Jina AI
Modelle
API
keyboard_arrow_down
Reader
Konvertieren Sie jede URL in Markdown für besseres Grounding von LLMs.
Einbettungen
Multimodale, mehrsprachige Einbettungen.
Reranker
Reranker zur Maximierung der Suchrelevanz.
MCP
terminal
CLI
article
llms.txt
smart_toy
Agenten
data_object
Schema
menu_book
Dokumentation
Einloggen
login
Einbettungen
Reranker
copyright CC BY-NC 4.0
open_in_new Release-Post

jina-colbert-v2

Der beste mehrsprachige ColBERT mit Top-Leistung beim Einbetten und Neuranking
Lizenz
copyright CC-BY-NC-4.0
Veröffentlichungsdatum
calendar_month
2024-08-31
Eingabe
abc
Text
arrow_forward
Ausgabe
apps
Multi-Vektor
Matryoshka-Dimensionen help_outline
64
96
128
Modelldetails
Parameter: 560M
Länge des Eingabetokens: 8K
Ausgabedimension: 128
Basismodell help_outline
jina-xlm-roberta
Ausgebildete Sprachen help_outline
89 Sprachen
Unterstützte Sprachen help_outline
108 Sprachen
Ähnliche Modelle
link
jina-colbert-v1-en
Erhältlich über
Jina-API
AWS SageMaker
Microsoft Azure
Google Cloud
Hugging Face
Air-Gapped
E/A-Diagramm 1

mehrere

Vektor

Abfrage

jina-colbert-v2

E/A-Diagramm 2

mehrere

Vektor

Dokument

jina-colbert-v2

Pareto-Fronthelp_outline
BEIR
MIRACL
chevron_leftchevron_right
30M100M300M1B3.0B50556065answerai-colbert-small-…bge-reranker-basebge-reranker-v2-m3ColBERTv2GTE-ModernColBERT-v1jina-reranker-m0jina-reranker-v1-base-enjina-reranker-v1-turbo-…jina-reranker-v2-base-m…jina-reranker-v3jina-reranker-v3.5ms-marco-MiniLM-L-4-v2mxbai-rerank-base-v1mxbai-rerank-base-v2mxbai-rerank-large-v2mxbai-rerank-xsmall-v1Qwen3-Reranker-0.6Bjina-colbert-v2Parameter (log)nDCG@10
Dieses Modell
Auf der Front
Jina AI
Andere
BEIR
54.49
Parameter
559M
Rang nach Score
12 / 21
Pareto-Front
Dahinter
Werteverteilunghelp_outline
AUC 0.9726
Korpus
Übersetzungspaare
Code
19.141518202325
Verwandt81.0%
Hartes Negativ10.3%
Unverwandt0.8%
Empfohlene Schwellenwerte
FPR 0.1 · 17.83
FPR 0.01 · 19.14
FPR 0.001 · 21.08
FPR 0.0001 · 23.67
ausgewogen · 18.66
AUC
0.9726
Rauschgrenze
21.05
Recall-Kante
16.22
Gemessene Paare
100 / 9,200
Score nach Ranghelp_outline
12345678910
Mittlerer Score je Rangposition
Wählen Sie Modelle zum Vergleichen aus
Publikationen (1)
EMNLP 2024
August 30, 2024
Jina-ColBERT-v2: A General-Purpose Multilingual Late Interaction Retriever

Überblick

jina-colbert-v2 ist ein 560M-Parameter mehrsprachiges Late-Interaction-Retrieval-Modell, das 89 Sprachen unterstützt. Es ist das erste mehrsprachige ColBERT-ähnliche Modell, das kompakte Embeddings auf Token-Ebene (64–128 Dimensionen pro Token) erzeugt, und ermöglicht damit skalierbare, kosteneffiziente mehrsprachige Suche. Matryoshka-Repräsentationslernen erlaubt die Dimensionsreduzierung von 128 auf 64 mit nur 1,5 % Performance-Abschlag und halbiert die Speicheranforderungen.

Methoden

Das Modell baut auf der ColBERT-Late-Interaction-Architektur mit einem modifizierten XLM-RoBERTa-Backbone (560M Parameter) auf, verstärkt um rotary position embeddings und optimiert mit Flash Attention. Das Training umfasst zwei wesentliche Stufen: (1) initialen Pretraining auf vielfältig schwach supervidierten Daten aus verschiedenen Sprachen, (2) Feintuning auf gelabelten Triplett-Daten und supervidierte Destillation von einem größeren Teacher-Modell. Die wesentliche Innovation ist die Implementierung von Matryoshka-Repräsentationslernen für Multi-Vektor-Embeddings: Das Modell erzeugt Vektoren auf Token-Ebene in 128, 96 oder 64 Dimensionen aus einem einzelnen Trainingslauf und ermöglicht damit dynamische Speicher-Optimierung ohne Re-Training. Der 8.192-Token-Dokument-Kontext (erweiterbar auf 12.288) und das 32-Token-Query-Limit werden über ALiBi-Position-Encodings verwaltet.

Leistung

Das Modell erreicht eine 6,5 % Verbesserung gegenüber dem ursprünglichen ColBERT-v2 in englischen Aufgaben, mit einem Durchschnittsscore von 0,521 über 14 BEIR-Benchmarks. Es übertrifft traditionelle BM25-basierte Retrieval-Methoden in allen getesteten Sprachen auf MIRACL-Benchmarks und zeigt besondere Stärke in cross-lingualen Szenarien. Die Reduktion von 128 auf 64 Dimensionen führt zu nur 1,5 % Performance-Abschlag und halbiert die Speicheranforderungen — zum Beispiel kostet das Speichern von 100 Millionen Dokumenten mit 64-dimensionalen Vektoren 659,62 $/Monat auf AWS gegenüber 1.319,24 $ für 128 Dimensionen. Die mehrsprachige Abdeckung des Modells (89 Sprachen) und die kompakten Token-Embeddings machen es einzigartig geeignet für globale Suchanwendungen.

Anleitung

Das Modell benötigt CUDA-fähige Hardware für optimale Performance. Es unterstützt Dokumentlängen bis zu 8.192 Tokens (erweiterbar auf 12.288) und begrenzt Queries auf 32 Tokens. Für Produktions-Deployment ist es über die Jina Search Foundation API, den AWS-Marktplatz und Azure verfügbar, mit einer nicht-kommerziellen Version auf Hugging Face. Bei der Implementierung angeben, ob Sie Queries oder Dokumente embedden — das Modell verwendet asymmetrisches Encoding. Das Modell ist nicht für Echtzeit-Verarbeitung extrem großer Dokumentkollections ohne geeignete Indexierung ausgelegt; für ANN-Suche FAISS, Qdrant oder Weaviate verwenden. Für domänenspezifische Aufgaben Feintuning auf Ihrem Korpus in Betracht ziehen. Für Single-Vektor-Retrieval mit höherdimensionalem Output jina-embeddings-v4 (Multi-Vektor-Modus) oder jina-embeddings-v5-text-small in Betracht ziehen.

Blogs, die dieses Modell erwähnen
Oktober 03, 2025 • 7 Minuten gelesen
Jina Reranker v3: 0.6B Listwise Reranker for SOTA Multilingual Retrieval
New 0.6B-parameter listwise reranker that considers the query and all candidate documents in a single context window.
Jina AI
Light blue background with stylized text in the center, composed of small dots or squares, evoking a modern and minimalistic
Dezember 16, 2024 • 2 Minuten gelesen
Re·Search: Order 2024 Yearbook of Search Foundation Advances
Discover Re·Search, our premium yearbook showcasing our best research articles and search foundation models in 2024. Featuring spot UV-coated hardcover, 160 full-color pages, and meticulous design throughout. Available worldwide at $35, shipping included.
Jina AI
Open red publication "ReSearch" volume 24 displayed on a white surface with a distinctive shadow casting over the pages.
Oktober 29, 2024 • 11 Minuten gelesen
Beyond CLIP: How Jina-CLIP Advances Multimodal Search
Learn how Jina-CLIP enhances OpenAI's CLIP with better retrieval accuracy and more diverse results through unified text-image embeddings.
Bo Wang
Alex C-G
Abstract digital landscape with wave-like green and pink dunes against a dark background, conveying a tranquil atmosphere.
August 30, 2024 • 10 Minuten gelesen
Jina ColBERT v2: Multilingual Late Interaction Retriever for Embedding and Reranking
Jina ColBERT v2 supports 89 languages with superior retrieval performance, user-controlled output dimensions, and 8192 token-length.
Jina AI
Dark-themed coding interface displaying English and Japanese characters with "JINA COLBERT V2" highlighted in the center.
Februar 20, 2024 • 16 Minuten gelesen
What is ColBERT and Late Interaction and Why They Matter in Search?
Jina AI's ColBERT on Hugging Face has set Twitter abuzz, bringing a fresh perspective to search with its 8192-token capability. This article unpacks the nuances of ColBERT and ColBERTv2, showcasing their innovative designs and why their late interaction feature is a game-changer for search.
Han Xiao
Neon theater or concert hall marquee letters lit up at night with city lights and faint "Adobe Sto" visible.
Aktuelle Sprache / Design
Search Foundation
Reader
Einbettungen
Reranker
Jina API-Schlüssel abrufen
Ratenbegrenzung
Über uns
Neuigkeiten
Jina-Logo herunterladen
open_in_new
Elastic-Logo herunterladen
open_in_new
API-Status
Elastic © 2026.SicherheitAGBPrivatsphäreCookie-EinstellungenMeine persönlichen Daten nicht verkaufen oder weitergeben
Diese Website und alle zugehörigen Inhalte, Software, Produkte und Dienstleistungen sind ausschließlich für den professionellen Gebrauch bestimmt. Eine Nutzung durch Endverbraucher ist weder vorgesehen noch empfohlen.