Elastic
Jina AI
Modelos
API
keyboard_arrow_down
Reader
Convierta cualquier URL a Markdown para un mejor anclaje de los LLM.
Embeddings
Embeddings multimodales y multilingües.
Reranker
Reranker para maximizar la relevancia de los resultados de búsqueda.
MCP
terminal
CLI
article
llms.txt
smart_toy
Agentes
data_object
Esquema
menu_book
Documentos
Acceso
login
Embeddings
Reranker
copyright CC BY-NC 4.0
open_in_new Publicación de lanzamiento

jina-colbert-v2

El mejor ColBERT multilingüe con el máximo rendimiento en integración y reranking
Licencia
copyright CC-BY-NC-4.0
Fecha de lanzamiento
calendar_month
2024-08-31
Entrada
abc
Texto
arrow_forward
Producción
apps
Multi-vectorial
Dimensiones Matryoshka help_outline
64
96
128
Detalles del modelo
Parámetros: 560M
Longitud del token de entrada: 8K
Dimensión de salida: 128
Modelo base help_outline
jina-xlm-roberta
Idiomas entrenados help_outline
89 idiomas
Idiomas admitidos help_outline
108 idiomas
Modelos relacionados
link
jina-colbert-v1-en
Disponible a través de
API de Jina
AWS SageMaker
Microsoft Azure
Nube de Google
Hugging Face
Air-gapped
Gráfico de E/S 1

múltiple

Vector

Consulta

jina-colbert-v2

Gráfico de E/S 2

múltiple

Vector

Documento

jina-colbert-v2

Frontera de Paretohelp_outline
BEIR
MIRACL
chevron_leftchevron_right
30M100M300M1B3.0B50556065answerai-colbert-small-…bge-reranker-basebge-reranker-v2-m3ColBERTv2GTE-ModernColBERT-v1jina-reranker-m0jina-reranker-v1-base-enjina-reranker-v1-turbo-…jina-reranker-v2-base-m…jina-reranker-v3jina-reranker-v3.5ms-marco-MiniLM-L-4-v2mxbai-rerank-base-v1mxbai-rerank-base-v2mxbai-rerank-large-v2mxbai-rerank-xsmall-v1Qwen3-Reranker-0.6Bjina-colbert-v2Parámetros (log)nDCG@10
Este modelo
En la frontera
Jina AI
Otros
BEIR
54.49
Parámetros
559M
Rango por score
12 / 21
Frontera de Pareto
Por detrás
Distribución de valoreshelp_outline
AUC 0.9726
Corpus
Pares de traducción
Código
19.141518202325
Relacionados81.0%
Negativo difícil10.3%
No relacionados0.8%
Umbrales recomendados
FPR 0.1 · 17.83
FPR 0.01 · 19.14
FPR 0.001 · 21.08
FPR 0.0001 · 23.67
equilibrado · 18.66
AUC
0.9726
Techo de ruido
21.05
Caída de exhaustividad
16.22
Pares medidos
100 / 9,200
Puntuación por posiciónhelp_outline
12345678910
Puntuación media en cada posición
Elija modelos para comparar
Publicaciones (1)
EMNLP 2024
agosto 30, 2024
Jina-ColBERT-v2: A General-Purpose Multilingual Late Interaction Retriever

Descripción general

jina-colbert-v2 es un modelo de recuperación de interacción tardía multilingüe de 560M parámetros que admite 89 idiomas. Es el primer modelo ColBERT-like multilingüe que genera embeddings compactos a nivel de token (64–128 dimensiones por token), lo que permite una búsqueda multilingüe escalable y rentable. El aprendizaje de representaciones Matryoshka permite reducir la dimensión de 128 a 64 con solo una disminución del 1,5 % en el rendimiento, reduciendo a la mitad los requisitos de almacenamiento.

Métodos

El modelo se basa en la arquitectura de interacción tardía de ColBERT con un backbone XLM-RoBERTa modificado (560M parámetros), mejorado con embeddings de posición rotacionales y optimizado con Flash Attention. El entrenamiento implica dos etapas clave: (1) preentrenamiento inicial con datos diversos débilmente supervisados de varios idiomas y (2) ajuste fino con datos de tripletes etiquetados y destilación supervisada desde un modelo maestro más grande. La innovación clave es la implementación del aprendizaje de representaciones Matryoshka para embeddings de vector múltiple: el modelo produce vectores a nivel de token en 128, 96 o 64 dimensiones a partir de un único proceso de entrenamiento, permitiendo la optimización dinámica del almacenamiento sin reentrenar. El contexto de documentos de 8.192 tokens (ampliable a 12.288) y el límite de consultas de 32 tokens se gestionan mediante codificaciones posicionales ALiBi.

Rendimiento

El modelo logra una mejora del 6,5 % sobre el ColBERT-v2 original en tareas en inglés, con una puntuación media de 0,521 en 14 benchmarks de BEIR. Supera a los métodos tradicionales de recuperación basados en BM25 en todos los idiomas probados en los benchmarks MIRACL, mostrando una fuerza particular en escenarios cross-lingüísticos. Reducir de 128 a 64 dimensiones produce solo una disminución del 1,5 % en el rendimiento y reduce a la mitad los requisitos de almacenamiento: por ejemplo, almacenar 100 millones de documentos con vectores de 64 dimensiones cuesta 659,62 $/mes en AWS, frente a 1.319,24 $ para 128 dimensiones. La cobertura multilingüe del modelo (89 idiomas) y sus embeddings de token compactos lo hacen único para aplicaciones de búsqueda global.

Guía

El modelo requiere hardware con soporte CUDA para un rendimiento óptimo. Admite longitudes de documentos de hasta 8.192 tokens (ampliables a 12.288), limitando las consultas a 32 tokens. Para despliegue en producción, está disponible a través de la Jina Search Foundation API, el marketplace de AWS y Azure, con una versión no comercial en Hugging Face. Al implementarlo, especifique si está generando embeddings de consultas o de documentos: el modelo usa codificación asimétrica. El modelo no está diseñado para procesar en tiempo real colecciones de documentos extremadamente grandes sin indexación adecuada; use FAISS, Qdrant o Weaviate para búsqueda ANN. Para tareas específicas de dominio, considere el ajuste fino en su corpus. Para recuperación de vector único con salida de mayor dimensión, considere jina-embeddings-v4 (modo de vector múltiple) o jina-embeddings-v5-text-small.

Blogs que mencionan este modelo
octubre 03, 2025 • 7 minutos de lectura
Jina Reranker v3: 0.6B Listwise Reranker for SOTA Multilingual Retrieval
New 0.6B-parameter listwise reranker that considers the query and all candidate documents in a single context window.
Jina AI
Light blue background with stylized text in the center, composed of small dots or squares, evoking a modern and minimalistic
diciembre 16, 2024 • 2 minutos de lectura
Re·Search: Order 2024 Yearbook of Search Foundation Advances
Discover Re·Search, our premium yearbook showcasing our best research articles and search foundation models in 2024. Featuring spot UV-coated hardcover, 160 full-color pages, and meticulous design throughout. Available worldwide at $35, shipping included.
Jina AI
Open red publication "ReSearch" volume 24 displayed on a white surface with a distinctive shadow casting over the pages.
octubre 29, 2024 • 11 minutos de lectura
Beyond CLIP: How Jina-CLIP Advances Multimodal Search
Learn how Jina-CLIP enhances OpenAI's CLIP with better retrieval accuracy and more diverse results through unified text-image embeddings.
Bo Wang
Alex C-G
Abstract digital landscape with wave-like green and pink dunes against a dark background, conveying a tranquil atmosphere.
agosto 30, 2024 • 10 minutos de lectura
Jina ColBERT v2: Multilingual Late Interaction Retriever for Embedding and Reranking
Jina ColBERT v2 supports 89 languages with superior retrieval performance, user-controlled output dimensions, and 8192 token-length.
Jina AI
Dark-themed coding interface displaying English and Japanese characters with "JINA COLBERT V2" highlighted in the center.
febrero 20, 2024 • 16 minutos de lectura
What is ColBERT and Late Interaction and Why They Matter in Search?
Jina AI's ColBERT on Hugging Face has set Twitter abuzz, bringing a fresh perspective to search with its 8192-token capability. This article unpacks the nuances of ColBERT and ColBERTv2, showcasing their innovative designs and why their late interaction feature is a game-changer for search.
Han Xiao
Neon theater or concert hall marquee letters lit up at night with city lights and faint "Adobe Sto" visible.
Idioma / tema actual
Search Foundation
Reader
Embeddings
Reranker
Obtener la clave API de Jina
Límite de velocidad
Sobre nosotros
Noticias
Descargar el logotipo de Jina
open_in_new
Descargar el logotipo de Elastic
open_in_new
Estado de la API
Elastic © 2026.SeguridadTérminos y condicionesPrivacidadAdministrar cookiesNo venda ni comparta mi información personal.
Este sitio web y su contenido, software, productos y servicios asociados están destinados exclusivamente a un uso profesional. El uso por parte de consumidores no está previsto ni dirigido.