Elastic
Jina AI
Modelle
API
keyboard_arrow_down
Reader
Konvertieren Sie jede URL in Markdown für besseres Grounding von LLMs.
Einbettungen
Multimodale, mehrsprachige Einbettungen.
Reranker
Reranker zur Maximierung der Suchrelevanz.
MCP
terminal
CLI
article
llms.txt
smart_toy
Agenten
data_object
Schema
menu_book
Dokumentation
Einloggen
login
Reranker
copyright CC BY-NC 4.0
open_in_new Release-Post

jina-reranker-v3

SOTA-Listwise-Reranker für mehrsprachiges Dokumenten-Retrieval
Lizenz
copyright CC-BY-NC-4.0
Veröffentlichungsdatum
calendar_month
2025-10-01
Eingabe
abc
Text (Abfrage)
abc
Text (Dokument)
arrow_forward
Ausgabe
format_list_numbered
Ranglisten
Modelldetails
Parameter: 597M
Länge des Eingabetokens: 131K
Ausgabedimension: 256
Basismodell help_outline
open_in_new
Qwen3-0.6B
Ausgebildete Sprachen help_outline
24 Sprachen
Unterstützte Sprachen help_outline
93 Sprachen
Quantisierungen help_outline
GGUF
Apple Silicon-Unterstützung help_outline
MLX
Ähnliche Modelle
link
jina-reranker-v3.5
link
jina-reranker-v2-base-multilingual
link
jina-reranker-m0
Erhältlich über
Elastic Inference Service
Jina-API
AWS SageMaker
Microsoft Azure
Google Cloud
Hugging Face
Air-Gapped
E/A-Diagramm

mehrere

Dokument

Abfrage

jina-reranker-v3

Ranking

Pareto-Fronthelp_outline
BEIR
MIRACL
chevron_leftchevron_right
30M100M300M1B3.0B50556065answerai-colbert-small-…bge-reranker-basebge-reranker-v2-m3ColBERTv2GTE-ModernColBERT-v1jina-colbert-v2jina-reranker-m0jina-reranker-v1-base-enjina-reranker-v1-turbo-…jina-reranker-v2-base-m…jina-reranker-v3.5ms-marco-MiniLM-L-4-v2mxbai-rerank-base-v1mxbai-rerank-base-v2mxbai-rerank-large-v2mxbai-rerank-xsmall-v1Qwen3-Reranker-0.6Bjina-reranker-v3Parameter (log)nDCG@10
Dieses Modell
Auf der Front
Jina AI
Andere
BEIR
62.10
Parameter
597M
Rang nach Score
4 / 21
Pareto-Front
Dahinter
Werteverteilunghelp_outline
AUC 0.8396
Korpus
Übersetzungspaare
Dokumentensuche
Code
0.020-0.200.000.200.400.60
Verwandt62.2%
Hartes Negativ18.2%
Unverwandt9.5%
Empfohlene Schwellenwerte
FPR 0.1 · 0.020
FPR 0.01 · 0.238
FPR 0.001 · 0.424
FPR 0.0001 · 0.600
ausgewogen · -0.008
AUC
0.8396
Rauschgrenze
0.414
Recall-Kante
-0.185
Gemessene Paare
119 / 2,856
Score nach Ranghelp_outline
12345678910
Mittlerer Score je Rangposition
Was Rang 1 gewinnthelp_outline
Ein korrekter Treffer gewinnt 45 % von 119 Anfragen
Pool-Empfindlichkeithelp_outline
Position in der Liste0.161
Pool-Größe0.088
Schwierigkeit der Füller0.015
Größter Score-Ausschlag beim selben Paar
Wählen Sie Modelle zum Vergleichen aus
Publikationen (1)
AAAI 2026
Oktober 01, 2025
jina-reranker-v3: Last but Not Late Interaction for Document Reranking

Überblick

jina-reranker-v3 ist ein 597M-Parameter mehrsprachiger listweiser Reranker, der die 'last but not late' (LBNL)-Interaktion einführt — einen Paradigmenwechsel vom paarweisen Cross-Encoder-Scoring. Statt jedes Query-Dokument-Paar isoliert zu bewerten, verarbeitet es eine gesamte Liste von Kandidatendokumenten gleichzeitig innerhalb eines einzelnen 131K-Token-Kontextfensters und nutzt kausale Aufmerksamkeit, um Dokument-zu-Dokument-Beziehungen zu erfassen. Es erreicht State-of-the-Art-BEIR-Performance (61,94 NDCG@10) mit 2,5× weniger Parametern als der nächstgelegene Wettbewerber.

Methoden

Die Kerninnovation ist die LBNL-Architektur. In einem Standard-Cross-Encoder wird jedes Query-Dokument-Paar unabhängig bewertet. In einem Late-Interaction-Modell (ColBERT) werden Dokumente separat codiert und tokenweise abgeglichen. LBNL kombiniert die Stärken beider: Query und alle Kandidatendokumente teilen einen einzelnen kausalen Aufmerksamkeitskontext, sodass das Modell über Dokumente hinweg Aufmerksamkeit schenken und relative Relevanz-Signale erfassen kann, die paarweises Scoring verfehlt. Das Modell verarbeitet bis zu 16 Dokumente pro Forward-Pass (während des Trainings ein Positives, 15 Negative), wobei jedes Dokument auf eine feste Länge gekürzt wird. Embeddings werden vom finalen Token jedes Dokuments via Last-Token-Pooling extrahiert, was den kausalen Aufmerksamkeitsmechanismus nutzt, um Informationen aus dem vorausgehenden Kontext natürlich zu aggregieren. Das 131K-Token-Kontextfenster wird durch Rotary-Position-Embeddings mit angepassten Basisfrequenzen ermöglicht. Das Training verwendet ein dreistufiges progressives Curriculum mit multi-zielorientiertem Loss, der InfoNCE, Dispersive-Loss (Gewicht 0,45), dual-Matching-Loss (Gewicht 0,85) und Similarity-Loss kombiniert.

Leistung

Auf BEIR erreicht das Modell 61,94 NDCG@10, den höchsten Wert unter allen evaluierten Rerankern und eine Verbesserung von 4,88 % gegenüber jina-reranker-v2. Es ist besonders stark in Multi-Hop-Retrieval (78,56 auf HotpotQA) und Faktenverifizierung (93,95 auf FEVER). Die mehrsprachige Performance erreicht 66,50 auf MIRACL über 18 Sprachen, mit Arabisch bei 78,69 und Thai bei 81,06. Code-Retrieval erreicht 63,28 auf CoIR. Es übertrifft den 1,5B mxbai-rerank-large (61,44) mit 2,5× weniger Parametern und zeigt eine Verbesserung von 5,43 % gegenüber bge-reranker-v2-m3 gleicher Größe. Die Performance ist relativ stabil über Dokumentanordnungen hinweg: zufällig (62,54), absteigend (61,94), aufsteigend (61,52) — was ein robustes listweises Scoring unabhängig von der Kandidatenanordnung anzeigt.

Anleitung

Verwenden Sie die strukturierte Prompt-Vorlage mit System/User/Assistant-Rollen und Sonder-Token für die Embedding-Extraktion. Verarbeiten Sie bis zu 64 Dokumente pro Forward-Pass für Sammlungen, die den 131K-Kontext überschreiten. Optimal bei Dokumenten, die zufällig oder nach absteigender Relevanz geordnet sind (Performance-Unterschied <1 %). Nutzen Sie die Dokument-zu-Dokument-Interaktionsfähigkeit für vergleichende Ranking-Aufgaben — das listweise Design des Modells erfasst Beziehungen zwischen Kandidaten, die paarweises Scoring verfehlt. Für mehrsprachige Anwendungen bietet das Modell starken Zero-Shot-Transfer über 18 Sprachen. Implementieren Sie Batch-Verarbeitung für große Dokumentsets und halten Sie Query-Embeddings konsistent über Batches hinweg. Die 256-dimensionalen Ausgabe-Embeddings unterstützen effiziente Similaritätsberechnung. Ideal für Multi-Hop-Reasoning und Faktenverifizierung. Für Produktion jina-reranker-v3.5 für 1,22–1,56× schnellere Inferenz über Hybrid-Attention verwenden.

Blogs, die dieses Modell erwähnen
August 03, 2026 • 11 Minuten gelesen
jina-reranker-v3.5: Faster Listwise Reranking with Hybrid Attention and Self-Distillation
A 0.6B listwise reranker that beats Qwen3-Reranker-4B on BEIR, reranks up to 1.56x faster than v3, and gains 9.6 nDCG@10 on semi-structured retrieval.
Jina AI
Oktober 03, 2025 • 7 Minuten gelesen
Jina Reranker v3: 0.6B Listwise Reranker for SOTA Multilingual Retrieval
New 0.6B-parameter listwise reranker that considers the query and all candidate documents in a single context window.
Jina AI
Light blue background with stylized text in the center, composed of small dots or squares, evoking a modern and minimalistic
Januar 22, 2025 • 10 Minuten gelesen
What Should We Learn From ModernBERT?
Bigger training data, efficient parameter sizing, and a deep-but-thin architecture, ModernBERT sets a direction for future BERT-like models.
Nan Wang
Alex C-G
Futuristic illustration with a central white circle surrounded by white dots on a dotted background.
September 18, 2024 • 10 Minuten gelesen
Jina Embeddings v3: A Frontier Multilingual Embedding Model
jina-embeddings-v3 is a frontier multilingual text embedding model with 570M parameters and 8192 token-length, outperforming the latest proprietary embeddings from OpenAI and Cohere on MTEB.
Jina AI
Dynamic image showing the characters "V3" formed by bright green dots varying in size on a black background.
Aktuelle Sprache / Design
Search Foundation
Reader
Einbettungen
Reranker
Jina API-Schlüssel abrufen
Ratenbegrenzung
Über uns
Neuigkeiten
Jina-Logo herunterladen
open_in_new
Elastic-Logo herunterladen
open_in_new
API-Status
Elastic © 2026.SicherheitAGBPrivatsphäreCookie-EinstellungenMeine persönlichen Daten nicht verkaufen oder weitergeben
Diese Website und alle zugehörigen Inhalte, Software, Produkte und Dienstleistungen sind ausschließlich für den professionellen Gebrauch bestimmt. Eine Nutzung durch Endverbraucher ist weder vorgesehen noch empfohlen.