Elastic
Jina AI
Modelli
API
keyboard_arrow_down
Reader
Converti qualsiasi URL in Markdown per un migliore ancoraggio dei LLM.
Embeddings
Embeddings multimodali e multilingue.
Reranker
Reranker per massimizzare la pertinenza dei risultati di ricerca.
MCP
terminal
CLI
article
llms.txt
smart_toy
Agenti
data_object
Schema
menu_book
Documenti
Login
login
Embeddings
Reranker
copyright CC BY-NC 4.0
open_in_new Post di rilascio

jina-colbert-v2

Il miglior ColBERT multilingue con le massime prestazioni nell'embedding e nelil reranking
Licenza
copyright CC-BY-NC-4.0
Data di rilascio
calendar_month
2024-08-31
Ingresso
abc
Testo
arrow_forward
Produzione
apps
Multivettore
Dimensioni Matryoshka help_outline
64
96
128
Dettagli del modello
Parametri: 560M
Lunghezza del token di input: 8K
Dimensione di uscita: 128
Modello base help_outline
jina-xlm-roberta
Lingue addestrate help_outline
89 lingue
Lingue supportate help_outline
108 lingue
Modelli correlati
link
jina-colbert-v1-en
Disponibile tramite
API di Jina
AWS SageMaker
Microsoft Azure
Google Cloud
Hugging Face
Air-gapped
Grafico I/O 1

multiplo

Vettore

Domanda

jina-colbert-v2

Grafico I/O 2

multiplo

Vettore

Documento

jina-colbert-v2

Frontiera di Paretohelp_outline
BEIR
MIRACL
chevron_leftchevron_right
30M100M300M1B3.0B50556065answerai-colbert-small-…bge-reranker-basebge-reranker-v2-m3ColBERTv2GTE-ModernColBERT-v1jina-reranker-m0jina-reranker-v1-base-enjina-reranker-v1-turbo-…jina-reranker-v2-base-m…jina-reranker-v3jina-reranker-v3.5ms-marco-MiniLM-L-4-v2mxbai-rerank-base-v1mxbai-rerank-base-v2mxbai-rerank-large-v2mxbai-rerank-xsmall-v1Qwen3-Reranker-0.6Bjina-colbert-v2Parametri (log)nDCG@10
Questo modello
Sulla frontiera
Jina AI
Altri
BEIR
54.49
Parametri
559M
Classifica per punteggio
12 / 21
Frontiera di Pareto
Dietro
Distribuzione dei valorihelp_outline
AUC 0.9726
Corpus
Coppie di traduzione
Codice
19.141518202325
Correlate81.0%
Negativo difficile10.3%
Non correlate0.8%
Soglie consigliate
FPR 0.1 · 17.83
FPR 0.01 · 19.14
FPR 0.001 · 21.08
FPR 0.0001 · 23.67
bilanciata · 18.66
AUC
0.9726
Soglia del rumore
21.05
Crollo del richiamo
16.22
Coppie misurate
100 / 9,200
Punteggio per posizionehelp_outline
12345678910
Punteggio medio a ogni posizione
Scegli i modelli da confrontare
Pubblicazioni (1)
EMNLP 2024
agosto 30, 2024
Jina-ColBERT-v2: A General-Purpose Multilingual Late Interaction Retriever

Panoramica

jina-colbert-v2 è un modello di retrieval a interazione tardiva multilingue da 560M parametri che supporta 89 lingue. È il primo modello ColBERT-like multilingue a generare embedding compatti a livello di token (64–128 dimensioni per token), abilitando una retrieval multilingue scalabile ed economica. L'apprendimento delle rappresentazioni Matryoshka consente la riduzione delle dimensioni da 128 a 64 con solo un calo dell'1,5% delle prestazioni, dimezzando i requisiti di archiviazione.

Metodi

Il modello si basa sull'architettura a interazione tardiva di ColBERT con un backbone XLM-RoBERTa modificato (560M parametri), migliorato con embedding posizionali rotazionali e ottimizzato con Flash Attention. L'addestramento prevede due fasi chiave: (1) pre-addestramento iniziale con dati debolmente supervisionati e variegati di diverse lingue, (2) fine-tuning su dati tripli etichettati e distillazione supervisionata da un modello teacher più grande. L'innovazione chiave è l'implementazione dell'apprendimento delle rappresentazioni Matryoshka per gli embedding multi-vettore: il modello produce vettori a livello di token in 128, 96 o 64 dimensioni da un unico processo di addestramento, abilitando l'ottimizzazione dinamica dello storage senza ri-addestramento. Il contesto di documento di 8.192 token (estendibile a 12.288) e il limite di query di 32 token sono gestiti tramite codifiche posizionali ALiBi.

Prestazione

Il modello raggiunge un miglioramento del 6,5% rispetto all'originale ColBERT-v2 sui task in inglese, con un punteggio medio di 0,521 su 14 benchmark BEIR. Supera i tradizionali metodi di retrieval basati su BM25 in tutte le lingue testate sui benchmark MIRACL, mostrando una forza particolare nei scenari cross-linguistici. Il passaggio da 128 a 64 dimensioni comporta solo un calo dell'1,5% delle prestazioni mentre dimezza i requisiti di archiviazione — ad esempio, archiviare 100 milioni di documenti con vettori a 64 dimensioni costa 659,62 $/mese su AWS, contro 1.319,24 $ per 128 dimensioni. La copertura multilingue del modello (89 lingue) e gli embedding di token compatti lo rendono unico per le applicazioni di retrieval globale.

Orientamento

Il modello richiede hardware con supporto CUDA per le prestazioni ottimali. Supporta lunghezze di documento fino a 8.192 token (estendibili a 12.288) limitando le query a 32 token. Per il deployment in produzione è disponibile tramite Jina Search Foundation API, AWS marketplace e Azure, con una versione non commerciale su Hugging Face. Durante l'implementazione, specifica se stai facendo embedding di query o di documenti — il modello usa codifica asimmetrica. Il modello non è progettato per l'elaborazione in tempo reale di collezioni di documenti estremamente grandi senza indicizzazione adeguata; usa FAISS, Qdrant o Weaviate per la ricerca ANN. Per task specifici di dominio, considera il fine-tuning sul tuo corpus. Per la retrieval a vettore singolo con output di dimensionalità superiore, considera jina-embeddings-v4 (modalità multi-vettore) o jina-embeddings-v5-text-small.

Blog che menzionano questo modello
ottobre 03, 2025 • 7 minuti letti
Jina Reranker v3: 0.6B Listwise Reranker for SOTA Multilingual Retrieval
New 0.6B-parameter listwise reranker that considers the query and all candidate documents in a single context window.
Jina AI
Light blue background with stylized text in the center, composed of small dots or squares, evoking a modern and minimalistic
dicembre 16, 2024 • 2 minuti letti
Re·Search: Order 2024 Yearbook of Search Foundation Advances
Discover Re·Search, our premium yearbook showcasing our best research articles and search foundation models in 2024. Featuring spot UV-coated hardcover, 160 full-color pages, and meticulous design throughout. Available worldwide at $35, shipping included.
Jina AI
Open red publication "ReSearch" volume 24 displayed on a white surface with a distinctive shadow casting over the pages.
ottobre 29, 2024 • 11 minuti letti
Beyond CLIP: How Jina-CLIP Advances Multimodal Search
Learn how Jina-CLIP enhances OpenAI's CLIP with better retrieval accuracy and more diverse results through unified text-image embeddings.
Bo Wang
Alex C-G
Abstract digital landscape with wave-like green and pink dunes against a dark background, conveying a tranquil atmosphere.
agosto 30, 2024 • 10 minuti letti
Jina ColBERT v2: Multilingual Late Interaction Retriever for Embedding and Reranking
Jina ColBERT v2 supports 89 languages with superior retrieval performance, user-controlled output dimensions, and 8192 token-length.
Jina AI
Dark-themed coding interface displaying English and Japanese characters with "JINA COLBERT V2" highlighted in the center.
febbraio 20, 2024 • 16 minuti letti
What is ColBERT and Late Interaction and Why They Matter in Search?
Jina AI's ColBERT on Hugging Face has set Twitter abuzz, bringing a fresh perspective to search with its 8192-token capability. This article unpacks the nuances of ColBERT and ColBERTv2, showcasing their innovative designs and why their late interaction feature is a game-changer for search.
Han Xiao
Neon theater or concert hall marquee letters lit up at night with city lights and faint "Adobe Sto" visible.
Lingua / tema attuale
Search Foundation
Reader
Embeddings
Reranker
Ottieni la chiave API Jina
Limite di velocità
Chi siamo
Notizie
Scarica il logo Jina
open_in_new
Scarica il logo Elastic
open_in_new
Stato dell'API
Elastic © 2026.SicurezzaTermini & CondizioniPrivacyGestisci i cookieNon vendere né condividere le mie informazioni personali
Questo sito web e tutti i contenuti, software, prodotti e servizi ad esso associati sono destinati esclusivamente all'uso professionale. Non è previsto né raccomandato alcun utilizzo da parte dei consumatori.