Elastic
Jina AI
Modelle
API
keyboard_arrow_down
Reader
Konvertieren Sie jede URL in Markdown für besseres Grounding von LLMs.
Einbettungen
Multimodale, mehrsprachige Einbettungen.
Reranker
Reranker zur Maximierung der Suchrelevanz.
MCP
terminal
CLI
article
llms.txt
smart_toy
Agenten
data_object
Schema
menu_book
Dokumentation
Einloggen
login
warning
Dieses Modell wird durch neuere Modelle ersetzt.
Einbettungen
Reranker
Apache 2.0 Lizenz
open_in_new Release-Post

jina-colbert-v1-en

Verbessertes ColBERT mit 8K-Token-Länge zum Einbetten und Neuordnen von Aufgaben
Lizenz
Apache-2.0
Veröffentlichungsdatum
calendar_month
2024-02-17
Eingabe
abc
Text
arrow_forward
Ausgabe
apps
Multi-Vektor
Modelldetails
Parameter: 137M
Länge des Eingabetokens: 8K
Ausgabedimension: 128
Basismodell help_outline
link
jina-embeddings-v2-base-en
Ausgebildete Sprachen help_outline
1 Sprachen
Erhältlich über
Jina-API
AWS SageMaker
Microsoft Azure
Hugging Face
Air-Gapped
E/A-Diagramm 1

mehrere

Vektor

Abfrage

jina-colbert-v1-en

E/A-Diagramm 2

mehrere

Vektor

Dokument

jina-colbert-v1-en

Pareto-Front help_outline
workspace_premium
LoCo
BEIR · arguana
BEIR · climatefever
chevron_leftchevron_right
30M100M7075808590ColBERTv2gte-reranker-modernbert…jina-reranker-v1-base-enjina-reranker-v1-tiny-enjina-reranker-v1-turbo-…jina-colbert-v1-enParameter (log)nDCG@10
Dieses Modell
Auf der Front
Jina AI
Andere
LoCo
83.70
Parameter
137M
Rang nach Score
3 / 6
Pareto-Front
Dahinter
Werteverteilunghelp_outline
AUC 0.5963
Korpus
Übersetzungspaare
15.7801020
Verwandt17.0%
Hartes Negativ9.3%
Unverwandt1.0%
Empfohlene Schwellenwerte
FPR 0.1 · 9.27
FPR 0.01 · 15.78
FPR 0.001 · 21.53
FPR 0.0001 · 25.48
ausgewogen · 7.98
AUC
0.5963
Rauschgrenze
21.44
Recall-Kante
-0.71
Gemessene Paare
100 / 9.200
Score nach Ranghelp_outline
12345678910
Mittlerer Score je Rangposition
Wählen Sie Modelle zum Vergleichen aus

Überblick

jina-colbert-v1-en ist ein 137M-Parameter englisches Late-Interaction-Retrieval-Modell, das Embeddings auf Token-Ebene (128-dimensional pro Token) anstelle eines einzigen Dokument-Vektors erzeugt. Dadurch wird Cross-Encoder-Qualität mit Bi-Encoder-Effizienz ermöglicht: Dokumente werden einmal indiziert, und die Relevanz-Bewertung erfolgt zur Query-Zeit via Max-Pooling und Summation über Token-Paare. Es unterstützt 8.192-Token-Dokumente und war das erste Jina-Modell, das ColBERT-Stil-Retrieval in Produktion brachte.

Methoden

Das Modell nutzt eine Late-Interaction-Architektur auf Basis eines adaptierten ColBERT-Ansatzes. Anstatt gesamte Dokumente auf einmal zu vergleichen, verarbeitet es Queries und Dokumente unabhängig bis zur finalen Matching-Stufe. Der Dokument-Encoder verarbeitet Text bis zu 8.192 Tokens; der Query-Encoder erzeugt präzise Repräsentationen auf Token-Ebene. Jedes Token in Query und Dokument erhält seinen eigenen 128-dimensionalen Embedding-Vektor, was feingranulare semantische Information erhält, die in Single-Vektor-Modellen verloren geht. Der Late-Interaction-Mechanismus berechnet Relevanz-Scores durch Max-Pooling über Query-Tokens und Summation über Dokument-Tokens, vermeidet die teure All-to-All-Attention von Cross-Encodern und erfasst gleichzeitig Matching-Signale auf Token-Ebene. Die Architektur verwendet 137M Parameter mit BERT-basierten Encodern und ALiBi-Position-Encodings für den 8.192-Token-Kontext.

Leistung

Auf der BEIR-Datensammlung erreicht das Modell überlegene Performance: 49,4 % auf Arguana (gegenüber 46,5 % für ColBERTv2), 79,5 % auf FEVER (gegenüber 78,8 %) und 75,0 % auf TREC-COVID (gegenüber 72,6 %). Am eindrucksvollsten ist die dramatische Verbesserung auf dem LoCo-Benchmark für Long-Context-Verständnis: 83,7 % gegenüber 74,3 % für ColBERTv2 — eine Steigerung von 9,4 Punkten, die den Wert token-Ebener Repräsentationen für lange Dokumente zeigt. Das Modell übertrifft traditionelle Single-Vektor-Embedding-Modelle und erhält dank des Late-Interaction-Ansatzes seine Recheneffizienz. Die 137M Parameter halten es für Produktions-Deployments praktikabel.

Anleitung

Verwenden Sie dieses Modell, wenn Sie Cross-Encoder-Retrieval-Qualität ohne Cross-Encoder-Latenz benötigen. Für optimale Performance ist eine CUDA-fähige GPU erforderlich; CPU-Inferenz ist für Entwicklung möglich. Das 8.192-Token-Dokument-Limit entspricht etwa 6.000 Wörtern und eignet sich für die meisten Dokumenttypen, einschließlich wissenschaftlicher Arbeiten und technischer Dokumentation. Das Modell ist nur englisch — für mehrsprachige Anwendungen jina-colbert-v2 verwenden. Für Produktions-Deployments geeignete Dokument-Chunking-Strategien implementieren und Vektor-Ähnlichkeits-Indizes (FAISS, Qdrant, Weaviate) für effizientes Retrieval verwenden. Das Modell ist insbesondere in RAG-Pipelines mit Frameworks wie RAGatouille effektiv, die die Late-Interaction-Implementierung vereinfachen. Für mehrsprachige oder höherpräzise Anforderungen jina-colbert-v2 oder jina-embeddings-v4 (Multi-Vektor-Modus) in Betracht ziehen.

Blogs, die dieses Modell erwähnen
August 30, 2024 • 10 Minuten gelesen
Jina ColBERT v2: Mehrsprachiger Late-Interaction-Retriever für Embedding und Reranking
Jina ColBERT v2 unterstützt 89 Sprachen mit überlegener Retrievalleistung, benutzerdefinierten Ausgabedimensionen und einer Token-Länge von 8192.
Jina AI
Dark-themed coding interface displaying English and Japanese characters with "JINA COLBERT V2" highlighted in the center.
Juni 19, 2024 • 11 Minuten gelesen
KI-Erklärbarkeit leicht gemacht: Wie Late Interaction Jina-ColBERT transparent macht
KI-Erklärbarkeit und Transparenz sind gefragte Themen. Wie können wir KI vertrauen, wenn wir nicht sehen können, wie sie funktioniert? Jina-ColBERT zeigt, wie Sie mit der richtigen Modellarchitektur Ihre KI dazu bringen können, ihre Geheimnisse preiszugeben.
Maximilian Werk
Scott Martens
Digital representation of a golden building seen through a blue and yellow mesh pattern, evoking a technological vibe.
Mai 13, 2024 • 5 Minuten gelesen
Albus von Springworks: Mitarbeiter durch Enterprise Search stärken
Erfahren Sie, wie ein führendes HR-Tech-Startup die Modelle von Jina AI nutzt, um mit strukturierten und unstrukturierten Daten zu kommunizieren.
Francesco Kruk
Saahil Ognawala
Albus logo in white on a dark blue background, surrounded by abstract blue shapes and symbols.
April 29, 2024 • 7 Minuten gelesen
Jina Embeddings und Reranker auf Azure: Skalierbare KI-Lösungen für Unternehmensanwendungen
Jina Embeddings und Reranker sind jetzt im Azure Marketplace verfügbar. Unternehmen, die Datenschutz und Sicherheit priorisieren, können Jina AIs hochmoderne Modelle nun problemlos direkt in ihr bestehendes Azure-Ökosystem integrieren.
Susana Guzmán
Futuristic black background with a purple 3D grid, featuring the "Embeddings" and "Reranker" logos with a stylized "A".
Februar 20, 2024 • 16 Minuten gelesen
Was ist ColBERT und Late Interaction und warum sind sie wichtig für die Suche?
Jina AIs ColBERT auf Hugging Face sorgt auf Twitter für Aufsehen und bringt mit seiner 8192-Token-Fähigkeit eine neue Perspektive in die Suche. Dieser Artikel erklärt die Feinheiten von ColBERT und ColBERTv2, zeigt ihre innovativen Designs und erläutert, warum ihre Late-Interaction-Funktion die Suche revolutioniert.
Han Xiao
Neon theater or concert hall marquee letters lit up at night with city lights and faint "Adobe Sto" visible.
Aktuelle Sprache / Design
Search Foundation
Reader
Einbettungen
Reranker
Jina API-Schlüssel abrufen
Ratenbegrenzung
Über uns
Neuigkeiten
Jina-Logo herunterladen
open_in_new
Elastic-Logo herunterladen
open_in_new
API-Status
Elastic © 2026.SicherheitAGBPrivatsphäreCookie-EinstellungenMeine persönlichen Daten nicht verkaufen oder weitergeben
Diese Website und alle zugehörigen Inhalte, Software, Produkte und Dienstleistungen sind ausschließlich für den professionellen Gebrauch bestimmt. Eine Nutzung durch Endverbraucher ist weder vorgesehen noch empfohlen.