Gráfico de E/S

Texto

jina-embeddings-v3

Tarea

Vector

Frontera de Pareto
30M100M300M1B3.0B10B30B506070all-MiniLM-L6-v2bge-base-en-v1.5bge-en-iclbge-multilingual-gemma2cde-small-v1e5-base-v2e5-small-v2EVA-CLIP ViT-B/16GritLM-8x7Bgte-basegte-smallKaLM-mini-v2.5LaBSELENS-d8000Linq-Embed-MistralLongCLIP ViT-B/16multilingual-e5-basemultilingual-e5-large-i…multilingual-e5-smallOpenAI CLIP ViT-B/16Qwen3-Embedding-0.6BSFR-Embedding-2_RSFR-Embedding-Mistralsnowflake-arctic-embed-lsnowflake-arctic-embed-…static-retrieval-mrl-en…stella_en_1.5B_v5stella_en_400M_v5jina-embeddings-v3Parámetros (log)score
Este modelo
En la frontera
Jina AI
Otros
MTEB English
65.52
Parámetros
572M
Rango por score
15 / 52
Frontera de Pareto
Por detrás
Distribución de valores
AUC 0.8525
Corpus
Pares de traducción
Búsqueda documental
Código
Tarea
default
classification
retrieval.passage
retrieval.query
retrieval.query → retrieval.passage
separation
text-matching
0.7410.200.400.600.80
Relacionados21.8%
Negativo difícil3.0%
No relacionados1.0%
Umbrales recomendados
FPR 0.1 · 0.618
FPR 0.01 · 0.741
FPR 0.001 · 0.797
FPR 0.0001 · 0.824
equilibrado · 0.597
AUC
0.8525
Techo de ruido
0.791
Caída de exhaustividad
0.385
Pares medidos
119 / 11k
Componentes del vector
-0.25-0.010.23
σ 0.0312 · 244k valores
Geometría del embedding
01024
Media por dimensión, pasa el cursor para ver el rango
Suelo de ruido
0.496
Dim. efectivas
54 / 1024
Truncado de dimensiones
32641282565121024
classification · Umbral según las dimensiones solicitadas
Pares de idiomas
de-ruen-deen-koen-zhja-ko
Dispersión del umbral entre pares: 0.072
Elija modelos para comparar
Publicaciones (4)

Descripción general

jina-embeddings-v3 es un modelo de embeddings de texto multilingüe de 570M parámetros que soporta 89 idiomas y una ventana de contexto de 8.192 tokens. Su innovación definitoria es el uso de adaptadores LoRA específicos de tarea: el mismo backbone de 570M produce embeddings optimizados para recuperación, clasificación, agrupamiento y coincidencia de texto intercambiando pesos de adaptadores ligeros (cada uno con menos de 60M parámetros). Alcanzó un rendimiento MTEB líder al lanzamiento, superando los embeddings propietarios de OpenAI y Cohere en tareas de inglés.

Métodos

El modelo se basa en un backbone jina-XLM-RoBERTa con 24 capas transformadoras, usando embeddings de posición rotatorios (RoPE) con una frecuencia base ajustada para la extrapulación de contexto largo hasta 8.192 tokens. El entrenamiento siguió un currículum de tres etapas: (1) preentrenamiento multilingüe en 89 idiomas, (2) ajuste contrastivo en conjuntos de datos de texto emparejado para establecer la calidad base de los embeddings, y (3) entrenamiento de adaptadores LoRA específicos de tarea. Cada adaptador LoRA añade menos del 3 % a la cuenta total de parámetros mientras especializa el modelo para una tarea específica: retrieval.query y retrieval.passage para búsqueda asimétrica, separation para agrupamiento, classification para categorización y text-matching para similitud semántica. El Matryoshka Representation Learning (MRL) permite la truncación de embeddings de 1024 a 32 dimensiones preservando más del 90 % de la calidad de recuperación a 64 dimensiones. Se admite el late chunking para documentos que exceden la ventana de contexto.

Rendimiento

En MTEB, jina-embeddings-v3 obtuvo una puntuación media de 65,52 en todas las tareas, con resultados especialmente fuertes en clasificación (82,58) y similitud de oraciones (85,80). Superó a multilingual-e5-large-instruct en todas las tareas multilingües y venció a e5-mistral-7b-instruct (12× la cantidad de parámetros) en tareas de inglés. En MTEB multilingüe, puntuó 64,44, demostrando un rendimiento consistente en 89 idiomas. La truncación MRL preservó el 92 % del rendimiento de recuperación a 64 dimensiones frente a los 1024 completos. En 2026, jina-embeddings-v5-text-small supera a este modelo para la mayoría de las cargas de trabajo, ofreciendo contexto de 32K y entrenamiento basado en destilación que produce mayor precisión por parámetro.

Guía

Seleccione el adaptador LoRA apropiado para su tarea: retrieval.query/retrieval.passage para búsqueda, separation para agrupamiento, classification para categorización, text-matching para similitud semántica. Use el parámetro `late_chunking para documentos que excedan 8.192 tokens. La truncación Matryoshka a 256 o 512 dimensiones es adecuada para indexación con restricciones de almacenamiento; use las 1024 dimensiones completas para re-ranking. El modelo requiere una GPU con soporte CUDA para el rendimiento de producción. Para nuevos proyectos multilingües, prefiera jina-embeddings-v5-text-small` (contexto de 32K, entrenado por destilación, mayor precisión). El modelo no está diseñado para la generación de texto o el razonamiento complejo — produce embeddings, no texto.

Blogs que mencionan este modelo