Elastic
Jina AI
Modelos
API
keyboard_arrow_down
Lector
Lea las URL y busque en la web para obtener una base más sólida para su LLM.
Incrustaciones
Incrustaciones multimodales y multilingües.
reclasificador
Reclasificador para maximizar la relevancia de los resultados de búsqueda.
Elastic Inference Service
Ejecuta modelos Jina de forma nativa dentro de Elasticsearch.
MCP
terminal
CLI
article
llms.txt
smart_toy
Agentes
data_object
Esquema
menu_book
Documentos
Acceso
login
warning
Este modelo está obsoleto por los modelos más nuevos.
reclasificador
copyright CC BY-NC 4.0
open_in_new Publicación de lanzamiento

jina-reranker-v2-base-multilingual

Reranker de codificador cruzado con soporte para búsqueda de código, llamadas de funciones y varios idiomas.
Licencia
copyright CC-BY-NC-4.0
Fecha de lanzamiento
calendar_month
2024-06-25
Aporte
abc
Texto (Consulta)
abc
Texto (Documento)
arrow_forward
Producción
format_list_numbered
Clasificaciones
Detalles del modelo
Parámetros: 278M
Longitud del token de entrada: 1K
Modelo base help_outline
open_in_new
XLM-RoBERTa Base
Idiomas entrenados help_outline
24 idiomas
Idiomas admitidos help_outline
108 idiomas
Modelos relacionados
link
jina-reranker-v1-base-en
link
jina-reranker-v1-turbo-en
link
jina-reranker-v1-tiny-en
Disponible a través de
Elastic Inference Service
API de Jina
AWS SageMaker
Microsoft Azure
Nube de Google
Hugging Face
Air-gapped
Gráfico de E/S

múltiple

Documento

Consulta

jina-reranker-v2-base-multilingual

Categoría

Pareto fronthelp_outline
BEIR
MIRACL
chevron_leftchevron_right
30M100M300M1B3.0B50556065answerai-colbert-small-…bge-reranker-basebge-reranker-v2-m3ColBERTv2GTE-ModernColBERT-v1jina-colbert-v2jina-reranker-m0jina-reranker-v1-base-enjina-reranker-v1-turbo-…jina-reranker-v3jina-reranker-v3.5ms-marco-MiniLM-L-4-v2mxbai-rerank-base-v1mxbai-rerank-base-v2mxbai-rerank-large-v2mxbai-rerank-xsmall-v1Qwen3-Reranker-0.6Bjina-reranker-v2-base-m…Parameters (log)nDCG@10
This model
On the front
Jina AI
Other
BEIR
57.06
Parameters
278M
Rank by score
7 / 21
Pareto front
On it
Distribución de valoreshelp_outline
AUC 0.8574
Corpus
Pares de traducción
Búsqueda documental
Código
0.3670.200.400.600.80
Relacionados63.0%
Negativo difícil19.0%
No relacionados9.9%
Umbrales recomendados
FPR 0.1 · 0.367
FPR 0.01 · 0.683
FPR 0.001 · 0.839
FPR 0.0001 · 0.862
equilibrado · 0.270
AUC
0.8574
Techo de ruido
0.832
Caída de exhaustividad
0.061
Pares medidos
119 / 2,856
Puntuación por posiciónhelp_outline
12345678910
Puntuación media en cada posición
Qué gana el primer puestohelp_outline
Una coincidencia correcta gana el 50 % de 119 consultas
Elige modelos para comparar

Descripción general

Jina Reranker v2 Base Multilingual es un modelo de codificador cruzado diseñado para mejorar la precisión de búsqueda en diferentes barreras lingüísticas y tipos de datos. Este reranker aborda el desafío crítico de la recuperación precisa de información en entornos multilingües, especialmente valioso para empresas globales que necesitan refinar los resultados de búsqueda en diferentes idiomas y tipos de contenido. Con soporte para más de 100 idiomas y capacidades únicas en llamadas de funciones y búsqueda de código, sirve como una solución unificada para equipos que requieren un refinamiento preciso de la búsqueda en contenido internacional, documentación de API y bases de código multilingües. El diseño compacto de 278M de parámetros del modelo lo hace particularmente atractivo para las organizaciones que buscan equilibrar el alto rendimiento con la eficiencia de los recursos.

Métodos

El modelo emplea una arquitectura de codificador cruzado mejorada con Flash Attention 2, lo que permite la comparación directa entre consultas y documentos para una evaluación de relevancia más precisa. Entrenado mediante un proceso de cuatro etapas, el modelo primero establece las capacidades del idioma inglés, luego incorpora progresivamente datos multilingües e interlingüísticos, antes del refinamiento final con ejemplos negativos duros. Este innovador enfoque de entrenamiento, combinado con la implementación de Flash Attention 2, permite al modelo gestionar una longitud de contexto de hasta 1024 tokens, con compatibilidad con fragmentación automática para documentos más extensos. La eficiencia de la arquitectura le permite gestionar tareas complejas de reclasificación en varios idiomas con un rendimiento seis veces superior al de su predecesor, a la vez que garantiza una evaluación de relevancia precisa mediante la interacción directa entre la consulta y el documento.

Actuación

En evaluaciones del mundo real, el modelo demuestra capacidades excepcionales en diversos puntos de referencia. Alcanza un rendimiento de vanguardia en la clasificación de AirBench para sistemas RAG y muestra sólidos resultados en tareas multilingües, incluido el conjunto de datos MKQA que cubre 26 idiomas. El modelo se destaca particularmente en tareas de datos estructurados, logrando altos puntajes de recuperación tanto en llamadas de funciones (punto de referencia ToolBench) como en coincidencias de esquemas SQL (punto de referencia NSText2SQL). Lo más impresionante es que ofrece estos resultados mientras procesa documentos 15 veces más rápido que modelos comparables como bge-reranker-v2-m3, lo que lo hace práctico para aplicaciones en tiempo real. Sin embargo, los usuarios deben tener en cuenta que el rendimiento óptimo requiere una GPU compatible con CUDA para la inferencia.

Guía

Para una implementación óptima, el modelo requiere una GPU compatible con CUDA y se puede acceder a él a través de múltiples canales, incluyendo la API Reranker, los principales frameworks RAG como Haystack y LangChain, o de forma privada a través de marketplaces en la nube. El modelo destaca en escenarios que requieren una comprensión precisa de las barreras lingüísticas y los tipos de datos, lo que lo hace ideal para empresas globales que trabajan con contenido multilingüe, documentación de API o repositorios de código. Con una ventana de contexto de 1024 tokens y fragmentación automática para documentos más largos, el modelo gestiona el contenido extendido de forma eficiente. Los equipos deberían considerar este modelo cuando necesiten mejorar la precisión de las búsquedas en diferentes idiomas, requieran capacidades de llamada a funciones para sistemas RAG con agentes o deseen mejorar la funcionalidad de búsqueda de código en bases de código multilingües. El modelo es especialmente eficaz cuando se utiliza junto con sistemas de búsqueda vectorial, donde puede mejorar significativamente la clasificación final de los documentos recuperados.
Blogs que mencionan este modelo
octubre 03, 2025 • 7 minutos de lectura
Jina Reranker v3: 0.6B Listwise Reranker for SOTA Multilingual Retrieval
New 0.6B-parameter listwise reranker that considers the query and all candidate documents in a single context window.
Jina AI
Light blue background with stylized text in the center, composed of small dots or squares, evoking a modern and minimalistic
abril 16, 2025 • 10 minutos de lectura
On the Size Bias of Text Embeddings and Its Impact in Search
Size bias refers to how the length of text inputs affects similarity, regardless of semantic relevance. It explains why search systems sometimes return long, barely-relevant documents instead of shorter, more precise matches to your query.
Scott Martens
Black background with a simple white ruler marked in centimeters, emphasizing a minimalist design.
abril 08, 2025 • 21 minutos de lectura
jina-reranker-m0: Multilingual Multimodal Document Reranker
Introducing jina-reranker-m0, our new multilingual multimodal reranker for retrieving visual documents, with SOTA performance on multilingual long documents and code searching tasks.
Jina AI
Modern dot matrix text display on a dark blue background, conveying a digital feel.
abril 01, 2025 • 17 minutos de lectura
Using DeepSeek R1 Reasoning Model in DeepSearch
Standard LLM or reasoning model, which is better for DeepSearch? In this post, we explored using DeepSeek-R1 in the DeepSearch implementation for choosing the next action.
Andrei Ungureanu
Alex C-G
Brown background with a stylized whale graphic and the text "THINK:" and ":SEARCH>" in code-like font.
marzo 12, 2025 • 11 minutos de lectura
Snippet Selection and URL Ranking in DeepSearch/DeepResearch
Nailing these two details takes your DeepSearch from mid to GOAT: selecting the best snippets from lengthy webpages and ranking URLs before crawling.
Han Xiao
Logo with words "THINK SEARCH THINK" in black dot and arrow patterns on an orange background, accompanied by horizontal lines
Idioma / tema actual
Search Foundation
Lector
Incrustaciones
reclasificador
Obtener la clave API de Jina
Límite de velocidad
Sobre nosotros
Noticias
Descargar el logotipo de Jina
open_in_new
Descargar el logotipo de Elastic
open_in_new
Estado de la API
Elastic © 2026.SeguridadTérminos y condicionesPrivacidadAdministrar cookiesNo venda ni comparta mi información personal.
Este sitio web y todo su contenido, software, productos y servicios asociados están destinados exclusivamente al uso profesional. No se permite ni se recomienda su uso por parte de consumidores.