Elastic
Jina AI
Modelos
API
keyboard_arrow_down
Reader
Convierta cualquier URL a Markdown para un mejor anclaje de los LLM.
Embeddings
Embeddings multimodales y multilingües.
Reranker
Reranker para maximizar la relevancia de los resultados de búsqueda.
MCP
terminal
CLI
article
llms.txt
smart_toy
Agentes
data_object
Esquema
menu_book
Documentos
Acceso
login
warning
Este modelo está obsoleto por los modelos más nuevos.
Embeddings
Reranker
Licencia Apache 2.0
open_in_new Publicación de lanzamiento

jina-colbert-v1-en

ColBERT mejorado con una longitud de token de 8K para tareas de embedding y reranking
Licencia
Apache-2.0
Fecha de lanzamiento
calendar_month
2024-02-17
Entrada
abc
Texto
arrow_forward
Producción
apps
Multi-vectorial
Detalles del modelo
Parámetros: 137M
Longitud del token de entrada: 8K
Dimensión de salida: 128
Modelo base help_outline
link
jina-embeddings-v2-base-en
Idiomas entrenados help_outline
1 idiomas
Disponible a través de
API de Jina
AWS SageMaker
Microsoft Azure
Hugging Face
Air-gapped
Gráfico de E/S 1

múltiple

Vector

Consulta

jina-colbert-v1-en

Gráfico de E/S 2

múltiple

Vector

Documento

jina-colbert-v1-en

Frontera de Pareto help_outline
workspace_premium
LoCo
BEIR · arguana
BEIR · climatefever
chevron_leftchevron_right
30M100M7075808590ColBERTv2gte-reranker-modernbert…jina-reranker-v1-base-enjina-reranker-v1-tiny-enjina-reranker-v1-turbo-…jina-colbert-v1-enParámetros (log)nDCG@10
Este modelo
En la frontera
Jina AI
Otros
LoCo
83.70
Parámetros
137M
Rango por score
3 / 6
Frontera de Pareto
Por detrás
Distribución de valoreshelp_outline
AUC 0.5963
Corpus
Pares de traducción
15.7801020
Relacionados17.0%
Negativo difícil9.3%
No relacionados1.0%
Umbrales recomendados
FPR 0.1 · 9.27
FPR 0.01 · 15.78
FPR 0.001 · 21.53
FPR 0.0001 · 25.48
equilibrado · 7.98
AUC
0.5963
Techo de ruido
21.44
Caída de exhaustividad
-0.71
Pares medidos
100 / 9200
Puntuación por posiciónhelp_outline
12345678910
Puntuación media en cada posición
Elija modelos para comparar

Descripción general

jina-colbert-v1-en es un modelo de recuperación de interacción tardía en inglés de 137M parámetros que produce embeddings a nivel de token (128 dimensiones por token) en lugar de un vector de documento único. Esto permite la calidad de un cross-encoder con la eficiencia de un bi-encoder: los documentos se indexan una vez y la puntuación de relevancia ocurre en el momento de la consulta mediante max-pooling y sumación sobre pares de tokens. Admite documentos de 8.192 tokens y fue el primer modelo de Jina en llevar la recuperación de estilo ColBERT a producción.

Métodos

El modelo emplea una arquitectura de interacción tardía basada en un enfoque ColBERT adaptado. En lugar de comparar documentos completos de una vez, procesa consultas y documentos de forma independiente hasta la etapa final de correspondencia. El codificador de documentos procesa texto de hasta 8.192 tokens; el codificador de consultas crea representaciones precisas a nivel de token. Cada token de la consulta y del documento recibe su propio vector de embedding de 128 dimensiones, conservando la información semántica de grano fino que se pierde en los modelos de vector único. El mecanismo de interacción tardía calcula las puntuaciones de relevancia mediante max-pooling sobre los tokens de la consulta y sumación sobre los tokens del documento, evitando la costosa atención all-to-all de los cross-encoders a la vez que capta señales de correspondencia a nivel de token. La arquitectura utiliza 137M parámetros con codificadores basados en BERT y codificaciones posicionales ALiBi para el contexto de 8.192 tokens.

Rendimiento

En la colección de datasets BEIR, el modelo alcanza un rendimiento superior: 49,4 % en Arguana (frente al 46,5 % de ColBERTv2), 79,5 % en FEVER (frente al 78,8 %) y 75,0 % en TREC-COVID (frente al 72,6 %). Lo más impresionante es la mejora dramática en el benchmark LoCo para comprensión de contexto largo, con 83,7 % frente al 74,3 % de ColBERTv2: una ganancia de 9,4 puntos que demuestra el valor de las representaciones a nivel de token para documentos largos. El modelo supera a los modelos de embedding de vector único tradicionales mientras mantiene la eficiencia computacional mediante el enfoque de interacción tardía. El recuento de 137M parámetros lo mantiene práctico para despliegues en producción.

Guía

Use este modelo cuando necesite calidad de recuperación de cross-encoder sin la latencia de un cross-encoder. Requiere una GPU con soporte CUDA para un rendimiento óptimo; la inferencia en CPU es posible para desarrollo. El límite de documentos de 8.192 tokens equivale a aproximadamente 6.000 palabras, adecuado para la mayoría de los tipos de documentos, incluidos artículos académicos y documentación técnica. El modelo es solo en inglés — para aplicaciones multilingües, use jina-colbert-v2. Para despliegues en producción, implemente estrategias adecuadas de segmentación (chunking) de documentos y use índices de similitud de vectores (FAISS, Qdrant, Weaviate) para una recuperación eficiente. El modelo es particularmente efectivo en pipelines de RAG con marcos como RAGatouille, que simplifican la implementación de interacción tardía. Para necesidades multilingües o de mayor precisión, considere jina-colbert-v2 o jina-embeddings-v4 (modo de vector múltiple).

Blogs que mencionan este modelo
agosto 30, 2024 • 10 minutos de lectura
Jina ColBERT v2: Recuperador de interacción tardía multilingüe para incrustación y reordenamiento
ColBERT v2 de Jina admite 89 idiomas con un rendimiento de recuperación superior, dimensiones de salida controladas por el usuario y una longitud de token de 8192.
Jina AI
Dark-themed coding interface displaying English and Japanese characters with "JINA COLBERT V2" highlighted in the center.
junio 19, 2024 • 11 minutos de lectura
Explicabilidad de la IA simplificada: Cómo la interacción tardía hace transparente a Jina-ColBERT
La explicabilidad y transparencia de la IA son temas candentes. ¿Cómo podemos confiar en la IA si no podemos ver cómo funciona? Jina-ColBERT te muestra cómo, con la arquitectura de modelo adecuada, puedes hacer fácilmente que tu IA revele sus secretos.
Maximilian Werk
Scott Martens
Digital representation of a golden building seen through a blue and yellow mesh pattern, evoking a technological vibe.
mayo 13, 2024 • 5 minutos de lectura
Albus de Springworks: Potenciando a los empleados con búsqueda empresarial
Descubre cómo una startup líder en tecnología de recursos humanos utiliza los modelos de Jina AI para interactuar con datos estructurados y no estructurados.
Francesco Kruk
Saahil Ognawala
Albus logo in white on a dark blue background, surrounded by abstract blue shapes and symbols.
abril 29, 2024 • 7 minutos de lectura
Embeddings y Reranker de Jina en Azure: Soluciones de IA escalables y listas para negocios
Los Jina Embeddings y Rerankers están ahora disponibles en Azure Marketplace. Las empresas que priorizan la privacidad y la seguridad ahora pueden integrar fácilmente los modelos de última generación de Jina AI directamente en su ecosistema Azure existente.
Susana Guzmán
Futuristic black background with a purple 3D grid, featuring the "Embeddings" and "Reranker" logos with a stylized "A".
febrero 20, 2024 • 16 minutos de lectura
¿Qué es ColBERT y la Interacción Tardía y Por Qué Son Importantes en la Búsqueda?
El ColBERT de Jina AI en Hugging Face ha causado revuelo en Twitter, aportando una nueva perspectiva a la búsqueda con su capacidad de 8192 tokens. Este artículo desglosa los matices de ColBERT y ColBERTv2, mostrando sus diseños innovadores y por qué su característica de interacción tardía es revolucionaria para la búsqueda.
Han Xiao
Neon theater or concert hall marquee letters lit up at night with city lights and faint "Adobe Sto" visible.
Idioma / tema actual
Search Foundation
Reader
Embeddings
Reranker
Obtener la clave API de Jina
Límite de velocidad
Sobre nosotros
Noticias
Descargar el logotipo de Jina
open_in_new
Descargar el logotipo de Elastic
open_in_new
Estado de la API
Elastic © 2026.SeguridadTérminos y condicionesPrivacidadAdministrar cookiesNo venda ni comparta mi información personal.
Este sitio web y su contenido, software, productos y servicios asociados están destinados exclusivamente a un uso profesional. El uso por parte de consumidores no está previsto ni dirigido.