Elastic
Jina AI
Modelos
API
keyboard_arrow_down
Lector
Lea las URL y busque en la web para obtener una base más sólida para su LLM.
Incrustaciones
Incrustaciones multimodales y multilingües.
reclasificador
Reclasificador para maximizar la relevancia de los resultados de búsqueda.
Elastic Inference Service
Ejecuta modelos Jina de forma nativa dentro de Elasticsearch.
MCP
terminal
CLI
article
llms.txt
smart_toy
Agentes
data_object
Esquema
menu_book
Documentos
Acceso
login

reclasificador

Maximice la relevancia de la búsqueda y la precisión de RAG con nuestra API de reranking de vanguardia.

API de reclasificación

Pruebe nuestra API de reranker de vanguardia para maximizar la relevancia de su búsqueda y la precisión de RAG. ¡Empezando gratis!
keyClave API y facturación
codeUso
more_horizMás
chevron_leftchevron_right

home
speedLímite de velocidad
bug_reportPlantear un problema
help_outlinePreguntas más frecuentes
Estado
chevron_leftchevron_right

Número de documentos devueltos
top_n
top_k
Número máximo de documentos mejor clasificados a devolver.

upload
Pedido
POST
curl "https://api.jina.ai/v1/rerank" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $JINA_API_KEY" \
-d @- <<EOFEOF
{ "model": null, "query": "Organic skincare products for sensitive skin", "top_n": 3, "documents": [ text_fieldsclose"Organic skincare for sensitive skin with aloe vera and chamomile: Imagine the soothing embrace of na…ing, healthy complexion.", text_fieldsclose"New makeup trends focus on bold colors and innovative techniques: Step into the world of cutting-edg…atement with every look.", text_fieldsclose"Bio-Hautpflege für empfindliche Haut mit Aloe Vera und Kamille: Erleben Sie die wohltuende Wirkung u…einen strahlenden Teint.", text_fieldsclose"Neue Make-up-Trends setzen auf kräftige Farben und innovative Techniken: Tauchen Sie ein in die Welt…jedes Mal ein Statement.", text_fieldsclose"Cuidado de la piel orgánico para piel sensible con aloe vera y manzanilla: Descubre el poder de la n…el radiante y saludable.", text_fieldsclose"Las nuevas tendencias de maquillaje se centran en colores vivos y técnicas innovadoras: Entra en el … y destaca en cada look.", text_fieldsclose"针对敏感肌专门设计的天然有机护肤产品:体验由芦荟和洋甘菊提取物带来的自然呵护。我们的护肤产品特别为敏感肌设计,温和滋润,保护您的肌肤不受刺激。让您的肌肤告别不适,迎来健康光彩。", text_fieldsclose"新的化妆趋势注重鲜艳的颜色和创新的技巧:进入化妆艺术的新纪元,本季的化妆趋势以大胆的颜色和创新的技巧为主。无论是霓虹眼线还是全息高光,每一款妆容都能让您脱颖而出,展现独特魅力。", text_fieldsclose"敏感肌のために特別に設計された天然有機スキンケア製品: アロエベラとカモミールのやさしい力で、自然の抱擁を感じてください。敏感肌用に特別に設計された私たちのスキンケア製品は、肌に優しく栄養を与え、保護します。肌トラブルにさようなら、輝く健康な肌にこんにちは。", text_fieldsclose"新しいメイクのトレンドは鮮やかな色と革新的な技術に焦点を当てています: 今シーズンのメイクアップトレンドは、大胆な色彩と革新的な技術に注目しています。ネオンアイライナーからホログラフィックハイライターまで、クリエイティビティを解き放ち、毎回ユニークなルックを演出しましょう。" + agregar entrada ], "return_documents": false }
EOFEOF


v3.5: Reclasificación de listas más rápida con atención híbrida y autodestilación.

jina-reranker-v3.5 is a 0.6B parameter multilingual listwise reranker with a 131K context window. Hybrid attention and self-distillation make it both faster and more robust across domains than v3, and it is a drop-in replacement: the request schema is unchanged.
Leer la nota de lanzamientoarrow_forward

m0: Rerankeador de documentos multimodales y multilingües

Nuestro nuevo reranker multimodal multilingüe para recuperar documentos visuales en varios idiomas, con rendimiento SOTA en documentos largos multilingües y tareas de búsqueda de código.
Leer la nota de lanzamientoarrow_forward

¿Qué es un reranker?

El objetivo de un sistema de búsqueda es encontrar los resultados más relevantes de forma rápida y eficaz. Tradicionalmente, se han utilizado métodos como BM25 o tf-idf para clasificar los resultados de búsqueda según la concordancia de palabras clave. En muchas bases de datos vectoriales se han implementado métodos recientes, como la similitud de coseno basada en incrustación. Estos métodos son sencillos, pero a veces pueden pasar por alto las sutilezas del lenguaje y, lo más importante, la interacción entre los documentos y la intención de una consulta. Aquí es donde brilla el "reranker". Un reranker es un modelo de IA avanzado que toma el conjunto inicial de resultados de una búsqueda (a menudo proporcionado por una búsqueda incrustada/basada en tokens) y los reevalúa para garantizar que se alineen más estrechamente con la intención del usuario. Mira más allá de la coincidencia superficial de términos para considerar la interacción más profunda entre la consulta de búsqueda y el contenido de los documentos.
account_tree
Así es como funciona:

1
Recuperación inicial
Un sistema de búsqueda utiliza embeddings/BM25 para encontrar un amplio conjunto de documentos potencialmente relevantes en función de la consulta del usuario.

2
Reclasificación
Luego, el reclasificador toma estos resultados y los analiza a un nivel más granular, considerando los matices de cómo los términos de consulta interactúan con el contenido del documento.

3
Resultados mejorados
Reordena los resultados de la búsqueda, colocando en la parte superior los que considera más relevantes, en base a este análisis más profundo.

El reclasificador puede mejorar significativamente la calidad de la búsqueda porque opera a nivel de subdocumento y subconsulta, lo que significa que analiza las palabras y frases individuales, sus significados y cómo se relacionan entre sí dentro de la consulta y los documentos. Esto da como resultado un conjunto de resultados de búsqueda más preciso y contextualmente relevante.
Jina Reranker v2 es un reordenador lanzado el 25 de junio de 2024; está diseñado para Agentic RAG. Ofrece soporte para llamadas a funciones, recuperación multilingüe para más de 100 idiomas, capacidades de búsqueda de código y una aceleración de 6 veces con respecto a la versión 1. Lea más sobre el modelo v2.
Recuperación multilingüe
Reranker v2 permite la recuperación de documentos en más de 100 idiomas, independientemente del idioma de consulta.

Llamada de funciones y búsqueda de códigos
Reranker v2 clasifica fragmentos de código y firmas de funciones en función de consultas en lenguaje natural, ideal para aplicaciones Agentic RAG.

Soporte de datos tabulares y estructurados
Reranker v2 clasifica las tablas más relevantes basándose en consultas en lenguaje natural, lo que ayuda a ordenar diferentes esquemas de tablas e identificar el más relevante antes de generar una consulta SQL.

Dos formas de comprar

Suscríbete a nuestra API o compra a través de proveedores de la nube.
radio_button_unchecked
cloud
Con 3 proveedores de servicios en la nube
¿Su empresa utiliza AWS o Azure? Luego, implemente directamente nuestros modelos básicos de búsqueda en estas plataformas de su empresa, para que sus datos se mantengan seguros y cumplan con las normas.
AWS SageMaker
Incrustaciones
reclasificador
Microsoft Azure
Incrustaciones
reclasificador
Google Cloud
Incrustaciones
radio_button_checked
Con la API de Jina Search Foundation
La forma más sencilla de acceder a todos nuestros productos. Recarga tokens a medida que avanzas.
Recarga esta clave API con más tokens
Dependiendo de su ubicación, es posible que se le cobre en USD, EUR u otras monedas. Se pueden aplicar impuestos.
Ingrese la clave API correcta para recargar
Entender el límite de velocidad
Los límites de velocidad son la cantidad máxima de solicitudes que se pueden realizar a una API en un minuto por dirección IP/clave API (RPM). Obtenga más información sobre los límites de velocidad para cada producto y nivel a continuación.
keyboard_arrow_down
Límite de velocidad
Los límites de velocidad se controlan de tres maneras: RPM (solicitudes por minuto) y TPM (tokens por minuto). Los límites se aplican por IP/clave API y se activan cuando se alcanza primero el umbral de RPM o TPM. Al proporcionar una clave API en el encabezado de la solicitud, controlamos los límites de velocidad por clave, no por dirección IP.
ProductoPunto final de APIDescripciónarrow_upwardSin clave APIkey_offcon clave API gratuitakeycon clave API de pagokeycon clave API PremiumkeyLatencia mediaRecuento de uso de tokensSolicitud Permitida
API de lectorhttps://r.jina.aiConvertir URL a texto compatible con LLM20 RPM500 RPM500 RPMtrending_up5000 RPM7.9sCuente la cantidad de tokens en la respuesta de salida.GET/POST
API de lectorhttps://s.jina.aiBusque en la web y convierta los resultados en texto compatible con LLMblock100 RPM100 RPMtrending_up1000 RPM2.5sCada solicitud cuesta una cantidad fija de tokens, a partir de 10000 tokensGET/POST
API de incrustaciónhttps://api.jina.ai/v1/embeddingsConvertir texto/imágenes en vectores de longitud fijablock100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
depende del tamaño de entrada
help
Cuente la cantidad de tokens en la solicitud de entrada.POST
API de reclasificaciónhttps://api.jina.ai/v1/rerankClasificar documentos por consultablock100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
depende del tamaño de entrada
help
Cuente la cantidad de tokens en la solicitud de entrada.POST

Implementación local

Implemente Jina Reranker en AWS Sagemaker y Microsoft Azure y pronto en Google Cloud Services, o comuníquese con nuestro equipo de ventas para obtener implementaciones personalizadas de Kubernetes para su nube privada virtual y servidores locales.
AWS SageMaker
Incrustaciones
reclasificador
Microsoft Azure
Incrustaciones
reclasificador
Google Cloud
Incrustaciones

Comparación de Reranker, Vector Search y BM25

La siguiente tabla proporciona una comparación completa de Reranker, Vector/Inbeddings Search y BM25, destacando sus fortalezas y debilidades en varias categorías.
reclasificadorBúsqueda de vectoresBM25
Mejor paraPrecisión y relevancia de búsqueda mejoradasFiltrado inicial y rápidoRecuperación de texto general en consultas de amplio alcance
GranularidadDetallado: subdocumento y segmento de consultaAmplio: documentos completosIntermedio: varios segmentos de texto
Complejidad del tiempo de consultaAltoMedioBajo
Complejidad del tiempo de indexaciónNo requeridoAltoBajo, utiliza índice prediseñado
Complejidad del tiempo de entrenamientoAltoAltoNo requerido
Calidad de búsquedaSuperior para consultas matizadasEquilibrado entre eficiencia y precisiónConsistente y confiable para un amplio conjunto de consultas
FortalezasAltamente preciso con una profunda comprensión contextual.Rápido y eficiente, con precisión moderada.Altamente escalable, con eficacia establecida
Pruebe la API de reranker gratisPruebe incorporar API de forma gratuita

Aprendiendo sobre Reranker

¿Qué es un reranker? ¿Por qué no es suficiente la búsqueda de vectores o la similitud de cosenos? Aprenda sobre los rerankers desde cero con nuestra guía completa.
agosto 03, 2026 • 11 minutos de lectura
jina-reranker-v3.5: Faster Listwise Reranking with Hybrid Attention and Self-Distillation
A 0.6B listwise reranker that beats Qwen3-Reranker-4B on BEIR, reranks up to 1.56x faster than v3, and gains 9.6 nDCG@10 on semi-structured retrieval.
Jina AI
jina-reranker-v3.5: An Efficient Listwise Reranker with Hybrid Attention and Self-Distillation
julio 20, 2026
jina-reranker-v3.5: An Efficient Listwise Reranker with Hybrid Attention and Self-Distillation
Listwise rerankers are the discriminative core of agentic retrieval pipelines, yet production deployment demands efficiency, domain robustness, and fluency on semi-structured data at the same time. We present jina-reranker-v3.5, a 0.6B-parameter listwise reranker that meets these demands together without sacrificing the cross-document comparison that makes its predecessor jina-reranker-v3 effective. It replaces uniform global attention with a hybrid schedule of three sliding-window layers followed by two global layers, pinning the terminal layer to global as last-but-not-late readout requires. It trains on a curated multi-domain mixture spanning legal, medical, financial, multilingual, and structured retrieval, and transfers quality through a three-stage self-distillation recipe in which a full-attention teacher sets an upper bound that a sparse-attention student then recovers. jina-reranker-v3.5 reaches 63.20 nDCG@10 on BEIR, matching a 4B model at roughly 7x fewer parameters, and lifts semi-structured retrieval by 9.6 nDCG@10 over jina-reranker-v3 while cutting listwise inference latency by up to 1.56x.
Light blue background with stylized text in the center, composed of small dots or squares, evoking a modern and minimalistic
octubre 03, 2025 • 7 minutos de lectura
Jina Reranker v3: 0.6B Listwise Reranker for SOTA Multilingual Retrieval
New 0.6B-parameter listwise reranker that considers the query and all candidate documents in a single context window.
Jina AI
jina-reranker-v3: Last but Not Late Interaction for Document Reranking
octubre 01, 2025
jina-reranker-v3: Last but Not Late Interaction for Document Reranking
jina-reranker-v3 is a 0.6B parameter multilingual document reranker that introduces a novel last but not late interaction. Unlike late interaction models such as ColBERT that perform separate encoding followed by multi-vector matching, our approach conducts causal self-attention between query and documents within the same context window, enabling rich cross-document interactions before extracting contextual embeddings from the last token of each document. This compact architecture achieves state-of-the-art BEIR performance with 61.94 nDCG@10 while being significant smaller than generative listwise rerankers.

Preguntas más frecuentes

¿Cuánto cuesta la API de Reranker?
keyboard_arrow_down
El precio de la API de Reranker sigue la misma estructura basada en tokens que la API de Embeddings, y los tokens se comparten entre todas las API de Jina con la misma clave. Las nuevas claves de API incluyen tokens gratuitos para empezar; además, se pueden adquirir paquetes de tokens. Consulta la sección de precios para obtener más información.
¿Cuáles son las diferencias entre los rerankers de Jina?
keyboard_arrow_down
jina-reranker-v3.5 es nuestro producto estrella actual: un reordenador multilingüe de listas con 0.600 millones de parámetros y 131.000 contextos, y un reemplazo directo para jina-reranker-v3. Mejora la versión 3 en todos los ejes que medimos, con las mayores ganancias en datos estructurados y recuperación legal, y se ejecuta de 1,22x a 1,56x más rápido. jina-reranker-v3 sigue disponible. jina-reranker-m0 es el reordenador multimodal para clasificar documentos visuales. jina-reranker-v2-base-multilingual es un codificador cruzado más pequeño que admite más de 100 idiomas, útil cuando se necesita un modelo no derivado de Qwen. jina-colbert-v2 utiliza interacción tardía en 89 idiomas.
¿Cómo se obtienen las licencias para los reclasificadores de Jina?
keyboard_arrow_down
jina-reranker-v3.5, jina-reranker-v3, jina-reranker-m0, jina-reranker-v2-base-multilingual y jina-colbert-v2 se publican bajo la licencia CC-BY-NC 4.0. Puede utilizarlos, compartirlos y adaptarlos libremente para fines no comerciales. El uso comercial en producción requiere una licencia comercial, que Elastic ha vendido como su propio SKU desde el 10 de agosto de 2026 bajo el nombre Jina On-Prem. Póngase en contacto con Elastic Sales para obtener un presupuesto. Los modelos heredados jina-reranker-v1-* siguen siendo Apache-2.0.
¿Los rerankers admiten varios idiomas?
keyboard_arrow_down
Sí, todos los reordenadores actuales son multilingües. jina-reranker-v3.5 mejora la versión 3 en MIRACL y en la recuperación multilingüe en general. jina-reranker-v3 y jina-reranker-v2-base-multilingual admiten más de 100 idiomas, jina-reranker-m0 maneja la clasificación visual de documentos multilingües y jina-colbert-v2 admite 89 idiomas.
¿Cuál es la longitud máxima del contexto para cada reordenador?
keyboard_arrow_down
La longitud del contexto varía según el modelo:

jina-reranker-v3.5: 131.072 tokens (consulta más todos los documentos combinados) con truncamiento automático
jina-reranker-v3: 131.072 tokens con truncamiento automático
jina-reranker-m0: 10.000 tokens
jina-reranker-v2-base-multilingual: 1.024 tokens, con fragmentación automática para documentos más largos
jina-colbert-v2: 8.192 tokens

Para los rerankers v1 y v2, las consultas se truncan automáticamente y los documentos largos se fragmentan con max-pooling en todos los fragmentos.
¿Existe un límite en la cantidad de documentos que puedo reclasificar por consulta?
keyboard_arrow_down
No hay un límite estricto en la cantidad de documentos por solicitud. Al igual que nuestra API de incrustaciones, la API de reranking agrupa las entradas internamente por número de tokens para optimizar el uso de la GPU. Puede enviar tantos documentos como necesite en una sola solicitud.
¿Qué latencia puedo esperar al reclasificar 100 documentos?
keyboard_arrow_down
La latencia varía de 100 milisegundos a 7 segundos, dependiendo en gran medida de la longitud de los documentos y de la consulta. Por ejemplo, reclasificar 100 documentos de 256 tokens cada uno con una consulta de 64 tokens lleva unos 150 milisegundos. Aumentar la longitud del documento a 4096 tokens aumenta el tiempo a 3,5 segundos. Si la longitud de la consulta aumenta a 512 tokens, el tiempo aumenta aún más a 7 segundos.
A continuación se muestra el costo de tiempo de reclasificar una consulta y 100 documentos en milisegundos:
Número de tokens en cada documento
Número de tokens en la consulta256512102420484096
64156323136621073571
128194369137721233598
256273475139721554299
5124681385211435367068
¿Se pueden alojar los sistemas de reclasificación de forma privada, en mi propia infraestructura o en mi propia cuenta en la nube?
keyboard_arrow_down
Sí. Los reordenadores están disponibles en los marketplaces de AWS, Azure y GCP para su implementación en su propia cuenta en la nube. Para infraestructuras autogestionadas, locales o aisladas, Elastic vende una licencia comercial (Jina On-Prem) que distribuye los modelos como contenedores Docker completamente offline. Póngase en contacto con Elastic Sales para obtener un presupuesto.
launchAWS SageMakerlaunchGoogle CloudlaunchMicrosoft Azure
¿Ofrecen algún sistema de reclasificación optimizado con datos específicos del dominio?
keyboard_arrow_down
Antes de solicitar un ajuste fino, pruebe jina-reranker-v3.5: se entrenó con autodestilación específicamente para la robustez del dominio y muestra grandes mejoras en la recuperación de datos legales y estructurados con respecto a la versión 3. Un reranker comercial bien elegido, junto con una mejor segmentación, suele cerrar más la brecha que un ajuste fino, y no tiene costo probarlo. Si aún así no cumple con sus expectativas para sus datos, un reranker específico del dominio es un servicio personalizado: comuníquese con Elastic Sales para definir el alcance.
Contacto
¿Cuál es el tamaño mínimo de imagen para los documentos?
keyboard_arrow_down
El tamaño de imagen mínimo aceptable para el modelo jina-reranker-m0 es 28x28 píxeles.
¿Qué es la reordenación por listas y en qué se diferencia de la reordenación por puntos?
keyboard_arrow_down
jina-reranker-v3 y jina-reranker-v3.5 utilizan una arquitectura basada en listas: la consulta y todos los candidatos comparten una ventana de contexto y se puntúan en una única pasada hacia adelante, de modo que el modelo puede comparar los documentos entre sí. Los reordenadores tradicionales basados ​​en puntos, incluido jina-reranker-v2-base-multilingual, puntúan cada documento de forma independiente con respecto a la consulta. La puntuación basada en listas es más precisa porque la relevancia suele ser relativa a lo que hay en el conjunto de candidatos.
¿Por qué la API impone una longitud de contexto diferente a la que admite el modelo?
keyboard_arrow_down
Algunos algoritmos de reordenamiento son capaces, desde el punto de vista arquitectónico, de manejar contextos más largos de los que admite la API alojada. Las secuencias muy largas consumen una cantidad considerable de memoria de GPU, por lo que ajustamos la configuración de servicio para equilibrar el rendimiento, la latencia y el coste en la mayoría de los casos de uso. Si necesita la longitud total del contexto arquitectónico, ejecute el modelo en su propia infraestructura y póngase en contacto con Elastic Sales para obtener una licencia comercial.
¿Cuáles son los límites de velocidad para la API de Reranker?
keyboard_arrow_down
Los límites de velocidad dependen del tipo de clave API:

Gratis: 100 RPM, 100K TPM
De pago: 500 RPM, 2M TPM
Premium: 5,000 RPM, 50M TPM

También hay un límite basado en IP de 10,000 solicitudes por 60 segundos. Los mismos límites se aplican a las API de Embeddings y Reranker, y los tokens se comparten entre todas las API de Jina en la misma clave.
¿Qué reclasificador debo elegir?
keyboard_arrow_down
Utilice jina-reranker-v3.5 para texto. Es un reemplazo directo para jina-reranker-v3: el esquema de solicitud no cambia, por lo que cambiar la cadena del modelo es toda la migración. Utilice jina-reranker-m0 cuando sus candidatos sean imágenes o documentos visualmente ricos. Utilice jina-reranker-v2-base-multilingual cuando necesite un modelo más pequeño o uno que no derive de una estructura base Qwen.

¿Cómo obtener mi clave API?

video_not_supported

¿Cuál es el límite de velocidad?

Límite de velocidad
Los límites de velocidad se controlan de tres maneras: RPM (solicitudes por minuto) y TPM (tokens por minuto). Los límites se aplican por IP/clave API y se activan cuando se alcanza primero el umbral de RPM o TPM. Al proporcionar una clave API en el encabezado de la solicitud, controlamos los límites de velocidad por clave, no por dirección IP.
ProductoPunto final de APIDescripciónarrow_upwardSin clave APIkey_offcon clave API gratuitakeycon clave API de pagokeycon clave API PremiumkeyLatencia mediaRecuento de uso de tokensSolicitud Permitida
API de lectorhttps://r.jina.aiConvertir URL a texto compatible con LLM20 RPM500 RPM500 RPMtrending_up5000 RPM7.9sCuente la cantidad de tokens en la respuesta de salida.GET/POST
API de lectorhttps://s.jina.aiBusque en la web y convierta los resultados en texto compatible con LLMblock100 RPM100 RPMtrending_up1000 RPM2.5sCada solicitud cuesta una cantidad fija de tokens, a partir de 10000 tokensGET/POST
API de incrustaciónhttps://api.jina.ai/v1/embeddingsConvertir texto/imágenes en vectores de longitud fijablock100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
depende del tamaño de entrada
help
Cuente la cantidad de tokens en la solicitud de entrada.POST
API de reclasificaciónhttps://api.jina.ai/v1/rerankClasificar documentos por consultablock100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
depende del tamaño de entrada
help
Cuente la cantidad de tokens en la solicitud de entrada.POST

¿Necesito una licencia comercial?

Autocomprobación de licencia CC BY-NC

play_arrow
¿Estás utilizando nuestra API alojada o nuestras imágenes oficiales en Azure, AWS o GCP?
play_arrow
Sí
No se requiere licencia adicional. El uso comercial está cubierto por los términos del servicio: regístrese y pague a través de este sitio web o del mercado en la nube.
play_arrow
No
play_arrow
¿Utiliza usted mismo los pesos del modelo en un producto o servicio comercial?
play_arrow
No
No es necesario comprar nada. Se permite la descarga, evaluación, comparación y uso para investigación bajo todas las licencias con las que publicamos, con la debida atribución.
play_arrow
Sí
play_arrow
¿Qué licencia tiene la modelo? Se indica en su página de Hugging Face.
play_arrow
Apache-2.0
Apache 2.0 permite el uso comercial. No es necesario comprar nada. Esto cubre nuestros modelos de generaciones anteriores v1 y v2.
play_arrow
CC BY-NC 4.0
Necesitas una licencia comercial. Desde el 10 de agosto de 2026, Elastic vende una para los modelos Jina como su propio producto, llamado Jina On-Prem. Cubre implementaciones autogestionadas, locales y aisladas de la red, y no requiere una suscripción a Elasticsearch.
Si ya eres cliente de Elastic, tu equipo de cuentas puede añadirlo a tu contrato actual.
Contacta con el departamento de ventas de Elastic
play_arrow
Licencia de investigación Qwen
Una licencia de investigación no permite el uso comercial, y una licencia comercial para nuestros otros modelos no se extiende a este. No existe una opción comercial para este modelo, ni para su alojamiento propio ni a través de la API. Elija un modelo con una de las otras dos licencias.
Preguntas comunes relacionadas con API
code
¿Puedo usar la misma clave API en todas las API de Jina?
keyboard_arrow_down
Sí. Una clave API es válida para todos los productos de la plataforma de búsqueda Jina AI, incluidas las API de Reader, Embeddings, Reranker, Classifier y Segmenter, y los tokens se comparten entre todos ellos.
code
¿Puedo monitorear el uso del token de mi clave API?
keyboard_arrow_down
Sí, el uso de tokens se puede monitorear en la pestaña "Clave API y facturación" ingresando su clave API, lo que le permite ver el historial de uso reciente y los tokens restantes. Si ha iniciado sesión en el panel de API, estos detalles también se pueden ver en la pestaña "Administrar clave API".
code
¿Qué debo hacer si olvido mi clave API?
keyboard_arrow_down
Si ha perdido una clave recargada y desea recuperarla, escriba a support AT jina.ai desde su correo electrónico registrado para recibir asistencia. Se recomienda iniciar sesión para mantener su clave API almacenada de forma segura y de fácil acceso.
Contacto
code
¿Caducan las claves API?
keyboard_arrow_down
No, nuestras claves API no tienen fecha de caducidad. Si una clave se ve comprometida, revoque usted mismo en el panel de control de administración de claves API, lo que tendrá efecto de inmediato; emita primero una clave de reemplazo si desea evitar el tiempo de inactividad. Cualquier saldo de tokens restante permanece en su cuenta en lugar de en la clave revocada. Si no puede acceder al panel de control o cree que la cuenta está comprometida, comuníquese con el Soporte de Elastic.
Contacto
code
¿Puedo transferir tokens entre claves API?
keyboard_arrow_down
Sí, puedes transferir tokens de una clave premium a otra. Después de iniciar sesión en tu cuenta en el panel de administración de claves API, usa la configuración de la clave que deseas transferir para mover todos los tokens pagos restantes.
code
¿Puedo revocar mi clave API?
keyboard_arrow_down
Sí, puedes revocar tu clave API si crees que se ha visto comprometida. Al revocar una clave, se deshabilitará de inmediato para todos los usuarios que la hayan almacenado, y todo el saldo restante y las propiedades asociadas quedarán inutilizables de forma permanente. Si la clave es una clave premium, tienes la opción de transferir el saldo restante pagado a otra clave antes de la revocación. Ten en cuenta que esta acción no se puede deshacer. Para revocar una clave, ve a la configuración de claves en el panel de control de administración de claves API.
code
¿Por qué la primera solicitud de algunos modelos es lenta?
keyboard_arrow_down
Esto se debe a que nuestra arquitectura sin servidor descarga ciertos modelos durante períodos de bajo uso. La solicitud inicial activa o "calienta" el modelo, lo que puede tardar unos segundos. Después de esta activación inicial, las solicitudes posteriores se procesan mucho más rápido.
code
¿Se utilizan mis datos de API para entrenar sus modelos?
keyboard_arrow_down
No. Nunca utilizamos sus solicitudes a la API, entradas o salidas para entrenar nuestros modelos de embedding, reranker u otros modelos. Sus datos siguen siendo suyos.
code
¿Cuáles son los límites de velocidad para las API de Jina?
keyboard_arrow_down
Se aplican límites de velocidad por clave API:

Gratis: 100 RPM, 100K TPM
De pago: 500 RPM, 2M TPM
Premium: 5,000 RPM, 50M TPM

También hay un límite basado en IP de 10,000 solicitudes cada 60 segundos. Los límites varían según el punto final; consulte la tabla de límites de velocidad anterior para obtener las cifras por punto final.
code
¿Existen límites de tamaño de lote para las API?
keyboard_arrow_down
No hay límite de tamaño de lote ni para la API de Embeddings ni para la de Reranker. Puede enviar tantos elementos o documentos como necesite por solicitud. Ambas API procesan las entradas internamente por lotes según el número de tokens para optimizar el uso de la GPU.
code
¿Las API de Jina son lo mismo que los modelos de Jina dentro de Elastic?
keyboard_arrow_down
No, son tres rutas separadas. Las API de Jina en este sitio son de autoservicio y de pago por uso con una clave de API de Jina. El Servicio de Inferencia Elástica (EIS) ejecuta modelos de Jina dentro de Elastic Cloud, facturado a través de su suscripción a Elastic, sin infraestructura que usted deba administrar. Jina On-Prem es una licencia comercial, vendida por Elastic como su propio SKU desde el 10 de agosto de 2026, para ejecutar los modelos en su propia infraestructura autogestionada, local o aislada. Para las rutas EIS y On-Prem, comuníquese con Ventas de Elastic.
Preguntas comunes relacionadas con la facturación
attach_money
¿La facturación se basa en el número de sentencias o solicitudes?
keyboard_arrow_down
Nuestro modelo de precios se basa en la cantidad total de tokens procesados, lo que permite a los usuarios la flexibilidad de asignar estos tokens en cualquier cantidad de oraciones, ofreciendo una solución rentable para diversos requisitos de análisis de texto.
attach_money
¿Hay una prueba gratuita disponible para nuevos usuarios?
keyboard_arrow_down
Sí. Los nuevos usuarios reciben una clave API generada automáticamente con tokens gratuitos que pueden usar en cualquiera de nuestros modelos. Una vez que se agoten los tokens gratuitos, pueden comprar tokens adicionales para la clave en la pestaña "Comprar tokens".
attach_money
¿Se cobran tokens por solicitudes fallidas?
keyboard_arrow_down
No, los tokens no se deducen por solicitudes fallidas.
attach_money
¿Qué métodos de pago se aceptan?
keyboard_arrow_down
Los pagos se procesan a través de Stripe y admiten una variedad de métodos de pago que incluyen tarjetas de crédito, Google Pay y PayPal para su comodidad.
attach_money
¿Está disponible la facturación para compras de tokens?
keyboard_arrow_down
Para las compras de tokens de autoservicio, Stripe emite una factura a la dirección de correo electrónico asociada a su cuenta de Stripe en el momento de la compra. Si necesita una orden de compra formal, un contrato negociado, documentación de adquisición o facturación consolidada, que se gestione a través de Elastic en lugar de Stripe, póngase en contacto con Elastic Sales.
attach_money
¿Cómo puedo comprar una licencia comercial en lugar de tokens API?
keyboard_arrow_down
Las compras de tokens en este sitio cubren el uso de las API de Jina alojadas. No otorgan licencia para ejecutar los pesos del modelo en su propia infraestructura. Para ello, Elastic vende una licencia comercial como su propio SKU desde el 10 de agosto de 2026, con un precio anual en lugar de por token. Contacte con Elastic Sales para obtener un presupuesto.
attach_money
¿Puedo pagar con factura o con orden de compra en lugar de con tarjeta?
keyboard_arrow_down
Las compras de tokens de autoservicio se procesan a través de Stripe y se facturan automáticamente al correo electrónico de su cuenta de Stripe. Para órdenes de compra, procesos de adquisición o volúmenes que superen lo que admite la recarga de autoservicio, póngase en contacto con Elastic Sales.
attach_money
Realicé el pago, pero mi saldo o límite de crédito no ha cambiado. ¿Qué debo revisar?
keyboard_arrow_down
El saldo y los límites de tarifa pertenecen a una clave API, no a la cuenta, por lo que lo primero que debe verificar es la clave en sí, en lugar de la página de la cuenta: introdúzcala en la pestaña Clave API y facturación y confirme el saldo y el nivel allí. Si la cuenta tiene más de una clave, los tokens están en la clave que se recargó, que puede no ser la clave que envía su aplicación. Un nuevo nivel también puede tardar un poco en propagarse después del pago. Si la clave muestra el saldo pero sigue limitada al nivel anterior, póngase en contacto con el soporte técnico.
attach_money
¿Cómo puedo cancelar, detener la recarga automática o eliminar un método de pago guardado?
keyboard_arrow_down
La facturación de autoservicio se gestiona desde el portal del cliente, al que se accede a través de la pestaña Clave API y Facturación. Allí se puede desactivar la recarga automática y eliminar los métodos de pago guardados. Al desactivar la recarga automática, se detienen los cargos futuros, pero el saldo ya comprado permanece disponible. Si también desea eliminar la cuenta y sus datos, o solicitar un reembolso, envíe su solicitud al servicio de asistencia. La eliminación de la cuenta se realiza manualmente y tarda algunos días hábiles. Recibirá una confirmación por escrito una vez finalizado el proceso.
Idioma / tema actual
Search Foundation
Lector
Incrustaciones
reclasificador
Obtener la clave API de Jina
Límite de velocidad
Sobre nosotros
Noticias
Descargar el logotipo de Jina
open_in_new
Descargar el logotipo de Elastic
open_in_new
Estado de la API
Elastic © 2026.SeguridadTérminos y condicionesPrivacidadAdministrar cookiesNo venda ni comparta mi información personal.
Este sitio web y todo su contenido, software, productos y servicios asociados están destinados exclusivamente al uso profesional. No se permite ni se recomienda su uso por parte de consumidores.