Elastic
Jina AI
Modelos
API
keyboard_arrow_down
Lector
Lea las URL y busque en la web para obtener una base más sólida para su LLM.
Incrustaciones
Incrustaciones multimodales y multilingües.
reclasificador
Reclasificador para maximizar la relevancia de los resultados de búsqueda.
Elastic Inference Service
Ejecuta modelos Jina de forma nativa dentro de Elasticsearch.
MCP
terminal
CLI
article
llms.txt
smart_toy
Agentes
data_object
Esquema
menu_book
Documentos
Acceso
login
reclasificador
copyright CC BY-NC 4.0
open_in_new Publicación de lanzamiento

jina-reranker-v3

Reranker por listas para la recuperación de documentos multilingües SOTA
Licencia
copyright CC-BY-NC-4.0
Fecha de lanzamiento
calendar_month
2025-10-01
Aporte
abc
Texto (Consulta)
abc
Texto (Documento)
arrow_forward
Producción
format_list_numbered
Clasificaciones
Detalles del modelo
Parámetros: 597M
Longitud del token de entrada: 131K
Dimensión de salida: 256
Modelo base help_outline
open_in_new
Qwen3-0.6B
Idiomas entrenados help_outline
24 idiomas
Idiomas admitidos help_outline
93 idiomas
Cuantizaciones help_outline
GGUF
Soporte para Apple Silicon help_outline
MLX
Modelos relacionados
link
jina-reranker-v3.5
link
jina-reranker-v2-base-multilingual
link
jina-reranker-m0
Disponible a través de
Elastic Inference Service
API de Jina
AWS SageMaker
Microsoft Azure
Nube de Google
Hugging Face
Air-gapped
Gráfico de E/S

múltiple

Documento

Consulta

jina-reranker-v3

Categoría

Pareto fronthelp_outline
BEIR
MIRACL
chevron_leftchevron_right
30M100M300M1B3.0B50556065answerai-colbert-small-…bge-reranker-basebge-reranker-v2-m3ColBERTv2GTE-ModernColBERT-v1jina-colbert-v2jina-reranker-m0jina-reranker-v1-base-enjina-reranker-v1-turbo-…jina-reranker-v2-base-m…jina-reranker-v3.5ms-marco-MiniLM-L-4-v2mxbai-rerank-base-v1mxbai-rerank-base-v2mxbai-rerank-large-v2mxbai-rerank-xsmall-v1Qwen3-Reranker-0.6Bjina-reranker-v3Parameters (log)nDCG@10
This model
On the front
Jina AI
Other
BEIR
62.10
Parameters
597M
Rank by score
4 / 21
Pareto front
Behind it
Distribución de valoreshelp_outline
AUC 0.8396
Corpus
Pares de traducción
Búsqueda documental
Código
0.020-0.200.000.200.400.60
Relacionados62.2%
Negativo difícil18.2%
No relacionados9.5%
Umbrales recomendados
FPR 0.1 · 0.020
FPR 0.01 · 0.238
FPR 0.001 · 0.424
FPR 0.0001 · 0.600
equilibrado · -0.008
AUC
0.8396
Techo de ruido
0.414
Caída de exhaustividad
-0.185
Pares medidos
119 / 2,856
Puntuación por posiciónhelp_outline
12345678910
Puntuación media en cada posición
Qué gana el primer puestohelp_outline
Una coincidencia correcta gana el 45 % de 119 consultas
Sensibilidad al conjuntohelp_outline
Posición en la lista0.161
Tamaño del conjunto0.088
Dificultad del relleno0.015
Mayor oscilación de puntuación en el mismo par
Elige modelos para comparar
Publicaciones (1)
AAAI 2026
octubre 01, 2025
jina-reranker-v3: Last but Not Late Interaction for Document Reranking

Descripción general

jina-reranker-v3 es un reranker de documentos multilingüe de 600 millones de parámetros que presenta una novedosa arquitectura de interacción "last but not late". A diferencia de la codificación independiente de ColBERT con coincidencia multivectorial, este modelo realiza autoatención causal entre la consulta y los documentos dentro de la misma ventana de contexto, lo que permite interacciones complejas entre documentos antes de extraer las incrustaciones contextuales del último token de cada documento. Desarrollado sobre Qwen3-0.6B con 28 capas de transformador y un proyector MLP ligero (1024→512→256), procesa hasta 64 documentos simultáneamente en un contexto de 131 000 tokens. El modelo alcanza un rendimiento BEIR de vanguardia con 61,94 nDCG-10, siendo 10 veces más pequeño que los rerankers generativos por lista.

Métodos

Emplea un entrenamiento progresivo de tres etapas con pérdida multiobjetivo que combina InfoNCE, pérdida dispersiva (0,45), pérdida de coincidencia dual (0,85) y pérdida de similitud (0,85). La etapa 1 utiliza el ajuste fino de LoRA (r = 16, α = 32) en conjuntos de datos específicos del dominio, incluyendo BGE-M3 y Cornstack, con 16 documentos por consulta. La etapa 2 amplía el contexto a 8192 tokens y extrae negativos duros en sistemas de recuperación con hasta 25 negativos con τ = 0,05. La etapa 3 fusiona modelos especializados con ponderaciones de 0,25 a 0,65. Los tokens especiales doc_emb y query_emb marcan las posiciones de extracción de incrustaciones. El entrenamiento utiliza indicaciones estructuradas con roles de sistema/usuario/asistente, colocando la consulta tanto al principio como al final para una atención bidireccional.

Actuación

Alcanza una puntuación de nDCG-10 de 61,94 en BEIR, la más alta entre todos los rerankers evaluados, con una mejora del 4,88 % respecto a jina-reranker-v2. Destaca en la recuperación multisalto con 78,56 en HotpotQA y en la verificación de hechos con 93,95 en FEVER. El rendimiento multilingüe alcanza 66,50 en MIRACL en 18 idiomas, con 78,69 en árabe y 81,06 en tailandés. La recuperación de código alcanza 63,28 en CoIR. Supera a mxbai-rerank-large de 1,5B (61,44) con 2,5 veces menos parámetros. Muestra una mejora del 5,43 % respecto a bge-reranker-v2-m3 de la misma escala. Relativamente estable en todos los ordenamientos de documentos: aleatorio (62,54), descendente (61,94) y ascendente (61,52).

Guía

Utilice una plantilla de solicitud estructurada con roles de sistema/usuario/asistente y tokens especiales para la extracción de incrustaciones. Procese hasta 64 documentos por pasada para colecciones que superen los 131 K de contexto. Óptimo para documentos ordenados aleatoriamente o por relevancia descendente. Aproveche la capacidad de interacción entre documentos para tareas de clasificación comparativa. Para aplicaciones multilingües, el modelo proporciona una sólida transferencia de cero disparos en 18 idiomas. Implemente el procesamiento por lotes para grandes conjuntos de documentos, manteniendo la consistencia de las incrustaciones de consultas en todos los lotes. Considere las incrustaciones de salida de 256 dimensiones para un cálculo de similitud eficiente. Ideal para aplicaciones que requieren tanto calidad de clasificación como eficiencia de inferencia, en particular razonamiento multisalto y tareas de verificación de hechos.
Blogs que mencionan este modelo
agosto 03, 2026 • 11 minutos de lectura
jina-reranker-v3.5: Faster Listwise Reranking with Hybrid Attention and Self-Distillation
A 0.6B listwise reranker that beats Qwen3-Reranker-4B on BEIR, reranks up to 1.56x faster than v3, and gains 9.6 nDCG@10 on semi-structured retrieval.
Jina AI
octubre 03, 2025 • 7 minutos de lectura
Jina Reranker v3: 0.6B Listwise Reranker for SOTA Multilingual Retrieval
New 0.6B-parameter listwise reranker that considers the query and all candidate documents in a single context window.
Jina AI
Light blue background with stylized text in the center, composed of small dots or squares, evoking a modern and minimalistic
enero 22, 2025 • 10 minutos de lectura
What Should We Learn From ModernBERT?
Bigger training data, efficient parameter sizing, and a deep-but-thin architecture, ModernBERT sets a direction for future BERT-like models.
Nan Wang
Alex C-G
Futuristic illustration with a central white circle surrounded by white dots on a dotted background.
septiembre 18, 2024 • 10 minutos de lectura
Jina Embeddings v3: A Frontier Multilingual Embedding Model
jina-embeddings-v3 is a frontier multilingual text embedding model with 570M parameters and 8192 token-length, outperforming the latest proprietary embeddings from OpenAI and Cohere on MTEB.
Jina AI
Dynamic image showing the characters "V3" formed by bright green dots varying in size on a black background.
Idioma / tema actual
Search Foundation
Lector
Incrustaciones
reclasificador
Obtener la clave API de Jina
Límite de velocidad
Sobre nosotros
Noticias
Descargar el logotipo de Jina
open_in_new
Descargar el logotipo de Elastic
open_in_new
Estado de la API
Elastic © 2026.SeguridadTérminos y condicionesPrivacidadAdministrar cookiesNo venda ni comparta mi información personal.
Este sitio web y todo su contenido, software, productos y servicios asociados están destinados exclusivamente al uso profesional. No se permite ni se recomienda su uso por parte de consumidores.