Elastic
Jina AI
Modelos
API
keyboard_arrow_down
Reader
Convierta cualquier URL a Markdown para un mejor anclaje de los LLM.
Embeddings
Embeddings multimodales y multilingües.
Reranker
Reranker para maximizar la relevancia de los resultados de búsqueda.
MCP
terminal
CLI
article
llms.txt
smart_toy
Agentes
data_object
Esquema
menu_book
Documentos
Acceso
login

Contactar con ventas

Haga crecer su negocio con Jina AI.

nights_stay El equipo de ventas está fuera, regresa en 53h

Dos formas de comprar

Suscríbete a nuestra API o compra a través de proveedores de la nube.
radio_button_unchecked
cloud
Con 3 proveedores de servicios en la nube
¿Utiliza su empresa AWS o Azure? Puede desplegar nuestros modelos directamente en la plataforma de nube de su empresa y gestionar la facturación a través de la cuenta CSP.
AWS SageMaker
Embeddings
Reranker
Microsoft Azure
Embeddings
Reranker
Google Cloud
Embeddings
radio_button_checked
Con la API de Jina Search Foundation
La forma más sencilla de acceder a todos nuestros productos. Recargue tokens a medida que avanza.
Recargue esta clave API con más tokens
Dependiendo de su ubicación, es posible que se le cobre en USD, EUR u otras monedas. Se pueden aplicar impuestos.
Ingrese la clave API correcta para recargar
Entender el límite de velocidad
Los límites de velocidad son la cantidad máxima de solicitudes que se pueden realizar a una API en un minuto por dirección IP/clave API (RPM). Conoce más sobre los límites de velocidad de cada producto y nivel a continuación.
keyboard_arrow_down
Límite de velocidad
Los límites de velocidad se controlan de dos maneras: RPM (solicitudes por minuto) y TPM (tokens por minuto). Los límites se aplican por IP/clave API y se activan cuando se alcanza primero el umbral de RPM o TPM. Al proporcionar una clave API en el encabezado de la solicitud, controlamos los límites de velocidad por clave, no por dirección IP.
ProductoPunto final de APIDescripciónarrow_upwardSin clave APIkey_offcon clave API gratuitakeycon clave API de pagokeycon clave API PremiumkeyLatencia mediaRecuento de uso de tokensSolicitud permitida
API de Readerhttps://r.jina.aiConvertir la URL en texto compatible con LLM20 RPM500 RPM500 RPMtrending_up5000 RPM7.9sContar el número de tokens en la respuesta de salida.GET/POST
API de Readerhttps://s.jina.aiBuscar en la web y convertir los resultados en texto compatible con LLMblock100 RPM100 RPMtrending_up1000 RPM2.5sCada solicitud cuesta una cantidad fija de tokens, a partir de 10000 tokensGET/POST
API de embeddinghttps://api.jina.ai/v1/embeddingsConvertir texto/imágenes en vectores de longitud fijablock100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
depende del tamaño de entrada
help
Contar el número de tokens en la solicitud de entrada.POST
API de Rerankerhttps://api.jina.ai/v1/rerankReordenar documentos según la consultablock100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
depende del tamaño de entrada
help
Contar el número de tokens en la solicitud de entrada.POST

Preguntas frecuentes

Jina AI × Elastic

handshake
¿Se conservará la marca Jina?
keyboard_arrow_down
Sí. Jina es una marca modelo dentro de Elastic. Piensa en Qwen de Alibaba, GPT de OpenAI o Kimi de Moonshot. La identidad legal se ha transferido a Elastic, lo que permite a Jina AI centrarse exclusivamente en los modelos fundacionales de búsqueda como marca.
handshake
¿En qué se centrará Jina AI en el futuro?
keyboard_arrow_down
Embeddings, rerankers y modelos pequeños para una mejor búsqueda, incluyendo modelos multimodales y de lectura. Nuestra misión aún no ha concluido, y nunca hemos ocultado nuestro objetivo: ser un proveedor líder de modelos de búsqueda.
handshake
¿Continuarán las ofertas de API y de mercado en la nube?
keyboard_arrow_down
Sí. Las API Reader, Embeddings y Reranker continúan desarrollándose y manteniéndose, y los modelos se siguen publicando en plataformas de mercado en la nube. Puede utilizar nuestros servicios API como antes. La única excepción es que no podemos prestar servicios a entidades o países sujetos a los controles de exportación de EE. UU.
handshake
¿Seguiréis lanzando modelos con pesos abiertos en Hugging Face?
keyboard_arrow_down
Sí. En Elastic, Jina sigue ampliando los límites de los modelos fundacionales de búsqueda y continuamos lanzando modelos de pesos abiertos.
handshake
¿Bajo qué licencia se publicarán estos modelos abiertos?
keyboard_arrow_down
La mayoría de los modelos actuales están bajo la licencia CC-BY-NC 4.0, y esperamos que esto continúe. Los modelos heredados de las generaciones v1 y v2 están bajo la licencia Apache-2.0, que permite el uso comercial sin restricciones. Un modelo, jina-embeddings-v4, está bajo la Qwen Research License que hereda de su modelo base: esta no permite ningún uso comercial, y no se le extiende ninguna licencia comercial. La licencia aplicable siempre se indica en la página del modelo en Hugging Face, así que consúltela allí en lugar de inferirla de la generación. Bajo la licencia CC-BY-NC 4.0, los pesos se pueden descargar, evaluar, comparar y usar en investigación de forma gratuita, con la debida atribución, mientras que para usarlos en un producto comercial se necesita una licencia comercial, que Elastic vende como su propio SKU. Póngase en contacto con Elastic Sales para obtener una.
handshake
¿Continuarás publicando artículos de investigación?
keyboard_arrow_down
Sí. Cada modelo que publicamos está respaldado por un artículo riguroso, y seguimos presentándolos a conferencias de primer nivel como ICLR, EMNLP, SIGIR, NeurIPS e ICML.
handshake
Aún no soy cliente de Jina ni de Elastic, pero quiero usar la API Reader, las API de modelos o las imágenes del marketplace en la nube. ¿Qué debo hacer?
keyboard_arrow_down
Simplemente regístrese y pague a través de nuestro sitio web o del mercado en la nube correspondiente, como antes.
handshake
¿Puedo comprar una licencia comercial para los modelos Jina de Elastic?
keyboard_arrow_down
Sí. Desde el 10 de agosto de 2026, Elastic vende licencias comerciales para modelos Jina directamente, como su propio SKU. Esto cubre la ejecución de modelos Jina en su propia infraestructura autogestionada, local o aislada de la red, y está disponible a través de los canales directos de Elastic, federales y de proveedores de servicios en la nube (CSP). La oferta se llama Jina On-Prem. Para obtener un presupuesto, póngase en contacto con Elastic Sales.
handshake
¿Qué es Jina On-Prem?
keyboard_arrow_down
Jina On-Prem es una licencia comercial más un conjunto de contenedores Docker autocontenidos que le permiten ejecutar modelos Jina completamente dentro de su propia infraestructura. Los contenedores no realizan conexiones externas: no hay llamadas a Hugging Face ni a ningún registro de modelos, ni servidor de licencias, telemetría ni punto final de registro, lo que los hace viables en una red aislada. Cubren el portafolio de modelos Jina, incluidos los modelos de embedding, reranking y lectura, y exponen los esquemas de API de Elastic Inference Service (EIS), OpenAI, Cohere, Voyage AI y Gemini, por lo que las aplicaciones existentes funcionan sin cambios de código. Es una SKU independiente: no se basa en Elastic Resource Units (ERU) y no necesita ejecutar Elasticsearch para usarlo. También funciona junto con Elasticsearch de código abierto. Está disponible para pedidos desde el 10 de agosto de 2026. Para disponibilidad y condiciones, contacte con Elastic Sales.
handshake
¿Cuál es el precio de Jina On-Prem?
keyboard_arrow_down
Se trata de una licencia anual, cuyo precio depende de los modelos que implemente y de la cantidad de hardware que ejecute la inferencia. No se cobra por usuario, por nodo ni por tamaño de modelo, y no hay facturación por token. Una implementación solo con CPU se contabiliza de la misma manera, en función de los procesadores utilizados para la inferencia. El precio no es autogestionable: póngase en contacto con Elastic Sales para obtener un presupuesto para su implementación.
handshake
¿Para quién es Jina On-Prem?
keyboard_arrow_down
Organizaciones que no pueden, o prefieren no, enviar datos a un servicio de IA en la nube. Los casos típicos incluyen entornos aislados y de alta seguridad, el sector público y de defensa, industrias reguladas como los servicios financieros y la atención médica, sistemas críticos de baja latencia o sin conexión, y equipos que desean un costo de inferencia fijo y predecible en lugar de precios por token. Si esta descripción coincide con su implementación, Elastic Sales puede analizar los detalles con usted.
handshake
Soy cliente de Elastic. ¿Puedo usar modelos Jina en Elastic Cloud sin desplegar nada?
keyboard_arrow_down
Sí. Los modelos Jina están disponibles a través del Elastic Inference Service (EIS), por lo que puede utilizarlos para la ingesta y la búsqueda sin aprovisionar nodos de aprendizaje automático ni administrar infraestructura de GPU. Los modelos generalmente disponibles en EIS incluyen jina-embeddings-v5-text-small, jina-embeddings-v5-text-nano, jina-embeddings-v5-omni-small, jina-embeddings-v5-omni-nano, jina-embeddings-v3, jina-clip-v2 y los rerankers jina-reranker-v3.5, jina-reranker-v3, jina-reranker-v2-base-multilingual y jina-reranker-m0. Consulte la documentación de Elastic para obtener la lista de modelos actual, las regiones compatibles y la versión mínima de pila para cada modelo.
handshake
Descargué los pesos de Hugging Face. ¿Necesito una licencia para usarlos en producción?
keyboard_arrow_down
Depende de la licencia que tenga el modelo, la cual se indica en su página en Hugging Face. Apache-2.0 permite el uso comercial sin costo alguno. Bajo CC-BY-NC 4.0, la evaluación, las pruebas de rendimiento y la investigación son gratuitas, pero el uso comercial en producción requiere una licencia comercial, que es la que proporciona Jina On-Prem. Una licencia de investigación no permite ningún uso comercial, y una licencia comercial para los demás modelos no se extiende a este, por lo que un modelo bajo una licencia de investigación no es apto para producción, independientemente del presupuesto. Tenga en cuenta que esto se refiere a los pesos: llamar a las API alojadas o a las imágenes oficiales del mercado en la nube con fines comerciales no requiere una licencia adicional. Para adquirir una, comuníquese con Elastic Sales.
handshake
Quiero firmar un contrato o un acuerdo personalizado que cubra los modelos de Jina. ¿Qué debo hacer?
keyboard_arrow_down
Contacte con Elastic Sales. La concesión de licencias comerciales, la contratación y el soporte para los modelos Jina se gestionan ahora a través del proceso estándar de ventas y soporte de Elastic.
handshake
Soy una entidad china que contrata sus servicios. ¿Puedo obtener una factura en chino (发票)?
keyboard_arrow_down
No se aplica a las recargas de API de autoservicio: estas se facturan automáticamente por la entidad que procesa el pago, la cual no puede emitir una factura en chino (发票). Para compras basadas en contratos, incluyendo Jina On-Prem, comuníquese con Elastic Sales para analizar las entidades contratantes disponibles y los acuerdos de facturación.
handshake
Soy cliente de Elastic y quiero aprender las mejores prácticas para embeddings y reordenamientos, o simplemente me interesa el desarrollo de Jina AI. ¿Qué debo hacer?
keyboard_arrow_down
Póngase en contacto con Elastic Sales y podremos organizar una sesión entre usted, el equipo de Jina AI y Elastic.
handshake
Si lanzan un nuevo modelo durante el período de vigencia de mi licencia, ¿está incluido?
keyboard_arrow_down
Se incluyen los modelos lanzados en la misma categoría durante el período de vigencia: no se requiere ningún nuevo contrato ni compra, ni se modifica la clave de licencia, que se emite para la categoría y no para un modelo individual. Los modelos con una licencia que no permite el uso comercial son la excepción, ya que no se les aplica ninguna licencia comercial. Para conocer la cobertura de un contrato específico, consulte con Elastic Sales.
handshake
¿Qué tipo de soporte incluye una licencia comercial y quién lo proporciona?
keyboard_arrow_down
La licencia incluye soporte de nivel empresarial bajo el acuerdo de nivel de servicio estándar. Usted se encarga de la implementación: descarga la imagen del contenedor y la ejecuta en su propio entorno, y el soporte puede ayudarle si la instalación le presenta algún problema. El soporte se gestiona mediante el proceso estándar de Elastic, al igual que todo lo contractual. Para conocer los niveles de servicio asociados a un acuerdo específico, consulte con Elastic Sales.
handshake
¿Qué términos de procesamiento de datos se aplican ahora que Jina forma parte de Elastic?
keyboard_arrow_down
El procesamiento de datos se rige por el acuerdo de procesamiento de datos de Elastic, en lugar de los términos anteriores de Jina AI GmbH. Esto es importante para los expedientes de adquisición que citan el antiguo acuerdo, por lo que conviene revisar cualquier documento redactado antes de la adquisición. Para conocer los términos actuales y cualquier detalle específico de su jurisdicción, póngase en contacto con Elastic Sales.

¿Cómo obtener mi clave API?

video_not_supported

¿Cuál es el límite de velocidad?

Límite de velocidad
Los límites de velocidad se controlan de dos maneras: RPM (solicitudes por minuto) y TPM (tokens por minuto). Los límites se aplican por IP/clave API y se activan cuando se alcanza primero el umbral de RPM o TPM. Al proporcionar una clave API en el encabezado de la solicitud, controlamos los límites de velocidad por clave, no por dirección IP.
ProductoPunto final de APIDescripciónarrow_upwardSin clave APIkey_offcon clave API gratuitakeycon clave API de pagokeycon clave API PremiumkeyLatencia mediaRecuento de uso de tokensSolicitud permitida
API de Readerhttps://r.jina.aiConvertir la URL en texto compatible con LLM20 RPM500 RPM500 RPMtrending_up5000 RPM7.9sContar el número de tokens en la respuesta de salida.GET/POST
API de Readerhttps://s.jina.aiBuscar en la web y convertir los resultados en texto compatible con LLMblock100 RPM100 RPMtrending_up1000 RPM2.5sCada solicitud cuesta una cantidad fija de tokens, a partir de 10000 tokensGET/POST
API de embeddinghttps://api.jina.ai/v1/embeddingsConvertir texto/imágenes en vectores de longitud fijablock100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
depende del tamaño de entrada
help
Contar el número de tokens en la solicitud de entrada.POST
API de Rerankerhttps://api.jina.ai/v1/rerankReordenar documentos según la consultablock100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
depende del tamaño de entrada
help
Contar el número de tokens en la solicitud de entrada.POST

¿Necesito una licencia comercial?

Autocomprobación de licencia CC BY-NC

play_arrow
¿Está utilizando nuestra API alojada o nuestras imágenes oficiales en Azure, AWS o GCP?
play_arrow
Sí
No se requiere licencia adicional. El uso comercial está cubierto por los términos del servicio: regístrese y pague a través de este sitio web o del mercado en la nube.
play_arrow
No
play_arrow
¿Usa usted mismo los pesos del modelo en un producto o servicio comercial?
play_arrow
No
No es necesario comprar nada. Se permite la descarga, evaluación, comparación y uso para investigación bajo todas las licencias con las que publicamos, con la debida atribución.
play_arrow
Sí
play_arrow
¿Qué licencia tiene la modelo? Se indica en su página de Hugging Face.
play_arrow
Apache-2.0
Apache 2.0 permite el uso comercial. No es necesario comprar nada. Esto cubre nuestros modelos de generaciones anteriores v1 y v2.
play_arrow
CC BY-NC 4.0
Necesita una licencia comercial. Desde el 10 de agosto de 2026, Elastic vende una para los modelos Jina como su propio producto, llamado Jina On-Prem. Cubre implementaciones autogestionadas, locales y aisladas de la red, y no requiere una suscripción a Elasticsearch.
Si ya es cliente de Elastic, su equipo de cuentas puede añadirlo a su contrato actual.
Póngase en contacto con el departamento de ventas de Elastic
play_arrow
Licencia de investigación de Qwen
Una licencia de investigación no permite el uso comercial, y una licencia comercial para nuestros otros modelos no se extiende a este. No existe una opción comercial para este modelo, ni para su alojamiento propio ni a través de la API. Elija un modelo con una de las otras dos licencias.

Otras preguntas

Preguntas comunes relacionadas con Reader
¿Cuáles son los costos asociados con el uso de Reader API?
keyboard_arrow_down
Reader es gratuito para uso básico: anteponga 'https://r.jina.ai/' a su URL. Proporcionar una clave API aumenta el límite de solicitudes y cobra tokens según la longitud del contenido. Consulte la pregunta 16 para obtener información sobre los límites de solicitudes.
¿Cómo funciona la API Reader?
keyboard_arrow_down
La API Reader obtiene la URL del lado del servidor y devuelve texto limpio y listo para LLM. Usted elige el motor de obtención con el encabezado X-Engine: direct realiza una solicitud HTTP simple y es la más rápida, el motor predeterminado renderiza la página en un navegador sin interfaz gráfica para que el JavaScript del lado del cliente se ejecute antes de la extracción, y cf-browser-rendering es un renderizador experimental respaldado por Cloudflare. Se eliminan elementos repetitivos como la navegación, los encabezados, los pies de página y los anuncios, y el contenido principal se convierte a Markdown. Use X-Respond-With para obtener otras formas de la misma página, y X-Target-Selector o X-Remove-Selector para mantener o eliminar selectores CSS específicos.
¿La API Reader es de código abierto?
keyboard_arrow_down
El código del servicio Reader está disponible en la organización Jina AI de GitHub. Los modelos utilizados por Reader, incluidos ReaderLM-v2 y jina-vlm, tienen licencia CC-BY-NC 4.0, que no es una licencia de código abierto: se pueden descargar y usar gratuitamente para fines no comerciales, pero para uso comercial en producción se requiere una licencia comercial. Elastic vende dicha licencia por separado desde el 10 de agosto de 2026; contacte con Elastic Sales para obtener una.
¿Cuál es la latencia típica de la API Reader?
keyboard_arrow_down
Depende principalmente del motor y de la página en sí. Una descarga directa de una página simple suele tardar unos cientos de milisegundos, mientras que el motor del navegador predeterminado tiene que cargar y ejecutar la página antes de extraerla, lo que generalmente tarda unos pocos segundos. Las aplicaciones pesadas de una sola página, los servidores de origen lentos y los PDF grandes tardan más. Si se repite la misma URL en un plazo de 5 minutos, se sirve desde la caché y la respuesta es casi inmediata, por lo que una URL caliente es mucho más rápida que una fría.
¿Por qué debería utilizar Reader API en lugar de raspar la página yo mismo?
keyboard_arrow_down
El scraping puede ser complicado y poco confiable, particularmente con páginas complejas o dinámicas. Reader API proporciona una salida optimizada y confiable de texto limpio y listo para LLM.
¿La API Reader admite varios idiomas?
keyboard_arrow_down
La API Reader es independiente del idioma y devuelve el contenido en el idioma original de la página; no lo traduce. La negociación de contenido está disponible a través del encabezado X-Locale, que establece la configuración regional del navegador utilizada al renderizar, de modo que los sitios que sirven un marcado diferente según la configuración regional pueden dirigirse a la versión deseada.
¿La API de Reader respeta los controles de acceso del sitio web?
keyboard_arrow_down
Sí. Reader funciona como un cliente web estándar y respeta los controles de acceso de los sitios web. Si un sitio web bloquea la solicitud, se respeta dicha decisión. Usted es responsable de garantizar que su uso de Reader cumpla con los términos de los sitios a los que acceda y no infrinja los derechos de propiedad intelectual de terceros.
¿Puede la API Reader extraer contenido de archivos PDF?
keyboard_arrow_down
Sí, la API de Reader puede extraer contenido de archivos PDF de forma nativa.
¿Puede la API Reader procesar contenido multimedia de páginas web?
keyboard_arrow_down
Sí, Reader puede añadir descripciones a imágenes en páginas web usando el encabezado x-with-generated-alt. Esto añade etiquetas alt descriptivas a las imágenes que no las tienen, lo que permite a los LLM comprender el contenido visual. Se planea incluir el resumen de vídeo en futuras versiones.
¿Es posible utilizar la API de Reader en archivos HTML locales?
keyboard_arrow_down
No, la API Reader solo puede procesar contenido de URL de acceso público.
¿Reader API almacena en caché el contenido?
keyboard_arrow_down
Si solicita la misma URL en un plazo de 5 minutos, la API de Reader devolverá el contenido almacenado en caché.
¿Puedo usar Reader API para acceder al contenido tras un inicio de sesión?
keyboard_arrow_down
Sí, para páginas que aceptan sesiones basadas en cookies. Pase sus cookies de sesión con el encabezado X-Set-Cookie y el Reader las reenviará al obtener la URL, usando el mismo formato <name>=<value> que un Set-Cookie normal, opcionalmente con ámbito ; domain=. Las solicitudes que contienen cookies nunca se almacenan en caché, por lo que cada una es una obtención nueva. Esto no realiza un inicio de sesión por usted: reproduce las credenciales que ya posee, por lo que es responsable de obtenerlas y de cumplir con los términos de servicio del sitio de destino. Los flujos que requieren un inicio de sesión interactivo, MFA o un token de portador que la página obtiene por sí misma están fuera del alcance.
¿Puedo utilizar la API de Reader para acceder a PDF en arXiv?
keyboard_arrow_down
Sí, puede utilizar la compatibilidad con PDF nativo del Reader (https://r.jina.ai/https://arxiv.org/pdf/2310.19923v4) o utilizar la versión HTML de arXiv (https://r.jina.ai/https://arxiv.org/html/2310.19923v4)
¿Cómo funciona el título de imagen en Reader?
keyboard_arrow_down
Reader añade descripciones a todas las imágenes en la URL especificada y agrega Image [idx]: [caption] como etiqueta alt (si inicialmente carecen de una). Esto permite a los LLM posteriores interactuar con las imágenes para razonar, resumir, etc.
¿Cuál es la escalabilidad del Reader? ¿Puedo usarlo en producción?
keyboard_arrow_down
La API Reader está diseñada para ser altamente escalable. Se escala automáticamente en función del tráfico en tiempo real y las solicitudes de concurrencia máxima ahora son de alrededor de 4000. Lo mantenemos activamente como uno de los productos principales de Jina AI. Así que siéntete libre de usarlo en producción.
¿Cuál es el límite de velocidad de la API Reader?
keyboard_arrow_down
Encuentre la información más reciente sobre el límite de tarifas en la siguiente tabla. Tenga en cuenta que estamos trabajando activamente para mejorar el límite de velocidad y el rendimiento de Reader API; la tabla se actualizará en consecuencia.
speedLímite de velocidad
¿Qué es ReaderLM? ¿Cómo puedo usarlo?
keyboard_arrow_down
ReaderLM-v2 es un modelo de lenguaje pequeño con 1.540 millones de parámetros que convierte HTML sin procesar en Markdown o JSON limpio, y puede extraer datos estructurados mediante un esquema JSON o instrucciones en lenguaje natural. Úselo a través de la API Reader con el encabezado x-respond-with: readerlm-v2, o impleméntelo desde los mercados de AWS, Azure o GCP. Para documentos con muchas imágenes o escaneados, jina-vlm es nuestro modelo de Reader de lenguaje visual con 2.400 millones de parámetros.
launchAWS SageMakerlaunchGoogle CloudlaunchMicrosoft Azure
¿Cómo extraigo datos estructurados de páginas web?
keyboard_arrow_down
Utilice el encabezado x-json-schema con una definición de esquema JSON o el encabezado x-instruction con instrucciones en lenguaje natural. Ambas funciones son compatibles con ReaderLM-v2 para extraer campos específicos, como precios, títulos, fechas, etc., de cualquier página web a formato JSON estructurado.
¿Reader elude activamente la protección anti-bots del sitio web?
keyboard_arrow_down
No. Reader no elude ni evade activamente ningún mecanismo de defensa, sistema antibot ni control de acceso de los sitios web. Si un sitio web detecta nuestro servicio como un bot y bloquea la solicitud, se respeta dicha decisión. Funcionamos como un cliente web estándar y no utilizamos técnicas diseñadas para evadir los sistemas de detección. Usted es responsable de garantizar que su uso de Reader respete los derechos de propiedad intelectual de terceros y los términos de los sitios a los que acceda.
¿Actualizar de una clave API gratuita a una paga me dará acceso a más sitios web?
keyboard_arrow_down
No. Actualizar de un nivel gratuito a una clave API de pago no otorga acceso a sitios web adicionales ni evita las restricciones de sitios. La diferencia entre los niveles radica principalmente en los límites de velocidad y las optimizaciones de rendimiento. Una clave API de pago proporciona un mayor rendimiento de solicitudes y un procesamiento más rápido, pero no permite el acceso a sitios web que bloquean nuestro servicio.
¿Puedo ejecutar Reader dentro de mi propia infraestructura?
keyboard_arrow_down
Sí. Los modelos de Reader se distribuyen como contenedores Docker autónomos sin conexión, bajo la licencia comercial Jina On-Prem que Elastic vende como su propia SKU desde el 10 de agosto de 2026. Esta es la opción para entornos aislados y con firewall, donde los contenedores no realizan conexiones salientes de ningún tipo. Tenga en cuenta que la obtención de páginas web públicas arbitrarias aún requiere acceso a la red; la ventaja de la versión local reside en ejecutar los modelos de extracción localmente. Póngase en contacto con Elastic Sales para obtener un presupuesto.
Preguntas comunes relacionadas con embeddings
¿Cómo se entrenaron los modelos de embedding de Jina?
keyboard_arrow_down
Para obtener información detallada sobre nuestros procesos de entrenamiento, fuentes de datos y evaluaciones, consulte los informes técnicos en arXiv. Los modelos de texto jina-embeddings-v5 se entrenan en dos etapas: destilación de embeddings a partir de un modelo maestro más grande, seguida del entrenamiento del adaptador LoRA específico para la tarea sobre pesos de la estructura base congelados. Las variantes multimodales v5-omni añaden una tercera etapa que entrena solo proyectores multimodales, dejando la estructura base del texto y los adaptadores congelados.
launcharXiv
¿Cuáles son sus modelos de embedding multimodal?
keyboard_arrow_down
jina-embeddings-v5-omni-small (~1,74B parámetros, 1024 dimensiones, 32K contexto) y jina-embeddings-v5-omni-nano (~1,04B parámetros, 768 dimensiones, 8K contexto) son nuestros modelos multimodales actuales. Aceptan texto, imágenes, audio, vídeo y PDF en un espacio vectorial compartido, por lo que puede indexar en una modalidad y consultar en otra sin reindexar. Su salida de solo texto es idéntica a jina-embeddings-v5-text-small y jina-embeddings-v5-text-nano respectivamente, lo que significa que puede agregar entrada multimodal a un índice de texto existente sin volver a incrustarlo. jina-clip-v2 (865M parámetros) sigue disponible como una opción más ligera de texto e imagen.
launcharXiv
¿Qué idiomas admiten sus modelos?
keyboard_arrow_down
Todos los modelos lanzados desde 2024 son multilingües. Los modelos jina-embeddings-v5-text-small y v5-omni se basan en una arquitectura Qwen3 con amplia cobertura multilingüe; jina-embeddings-v5-text-nano se basa en EuroBERT-210M, que cubre 15 idiomas europeos y globales importantes, incluidos inglés, francés, alemán, español, chino, japonés, árabe e hindi. jina-embeddings-v3 y jina-clip-v2 admiten 89 idiomas. Para obtener cifras de referencia por idioma, consulte los resultados de MMTEB en el informe técnico de cada modelo.
launcharXiv
¿Cuál es la longitud máxima del contexto para una sola entrada?
keyboard_arrow_down
La longitud del contexto varía según el modelo: jina-embeddings-v5-text-small y jina-embeddings-v5-omni-small admiten hasta 32.768 tokens, mientras que jina-embeddings-v5-text-nano y jina-embeddings-v5-omni-nano admiten 8.192 tokens. jina-embeddings-v4 y los modelos jina-code-embeddings admiten 32.768 tokens; jina-embeddings-v3, jina-clip-v2 y jina-colbert-v2 admiten 8.192 tokens. Las entradas que superen el límite devuelven un error a menos que establezca truncate: true.
¿Cuál es el número máximo de entradas que puedo incluir en una sola solicitud?
keyboard_arrow_down
No existe un límite estricto en la cantidad de elementos por solicitud. La API agrupa internamente las entradas según el número de tokens para optimizar el uso de la GPU, por lo que puede enviar tantos textos o imágenes como necesite en una sola solicitud. Los archivos PDF son la excepción: envíe un PDF por solicitud.
¿Cómo puedo enviar imágenes, audio, vídeo o archivos PDF a los modelos multimodales?
keyboard_arrow_down
Pase un objeto tipado en el array input usando una clave image, audio, video o pdf, cuyo valor es una URL pública o bytes codificados en base64. El modelo dirige cada modalidad al codificador apropiado, y puede combinar modalidades libremente dentro de un mismo lote. Los formatos de audio compatibles incluyen WAV, MP3, FLAC, OGG, M4A y Opus; el vídeo se procesa como 32 fotogramas muestreados uniformemente. Los PDF deben enviarse uno por solicitud.
¿Cómo se comparan los embeddings de Jina con los últimos modelos de OpenAI, Cohere y Voyage?
keyboard_arrow_down
jina-embeddings-v5-text-small (677M parámetros) es el modelo más fuerte con 1B parámetros en MMTEB, con una puntuación promedio de 67,0 a nivel de tarea, y alcanza un promedio de 71,7 en MTEB en inglés. jina-embeddings-v5-text-nano (239M parámetros) obtiene una puntuación de 65,5 en MMTEB, por delante de todos los modelos que evaluamos con 500M parámetros. Nuestro objetivo de diseño es la capacidad por parámetro en lugar del tamaño bruto, por lo que estos modelos son más económicos de implementar que la mayoría de las alternativas con una calidad de recuperación comparable o mejor. Todos los modelos v5 admiten Matryoshka Representation Learning, por lo que puede truncar las dimensiones hasta 32 sin volver a entrenar.
¿Qué tan fluida es la transición de text-embedding-3-large de OpenAI a su solución?
keyboard_arrow_down
La transición es sencilla: nuestro endpoint de API coincide con los esquemas JSON de entrada y salida de text-embedding-3-large de OpenAI, por lo que en la mayoría de las bases de código solo se cambia la URL base, la clave API y el nombre del modelo. Lo mismo ocurre con los contenedores Jina On-Prem, que además exponen los esquemas de Elastic Inference Service (EIS), Cohere, Voyage AI y Gemini, por lo que los modelos Jina son un reemplazo directo en las rutas de código existentes. Tenga en cuenta que los embeddings de diferentes familias de modelos no son comparables, por lo que debe volver a incrustar su corpus en lugar de mezclar vectores de dos proveedores en un índice. Para los contenedores On-Prem, póngase en contacto con Elastic Sales.
¿Cómo se calculan los tokens para imágenes y otras entradas que no sean de texto?
keyboard_arrow_down
El texto se contabiliza de la forma estándar. Las entradas que no son de texto se convierten en tokens mediante el codificador correspondiente, y el coste depende en gran medida del modelo que se utilice, por lo que conviene medir con las propias entradas en lugar de hacer suposiciones. Como referencia, una imagen de 600x600 píxeles cuesta aproximadamente: • jina-embeddings-v5-omni-small: ~363 tokens • jina-embeddings-v5-omni-nano: ~362 tokens • jina-embeddings-v4: ~4840 tokens • jina-clip-v2: ~16 000 tokens Los modelos v5-omni son entre uno y dos órdenes de magnitud más económicos por imagen que los modelos anteriores. Cada respuesta incluye un objeto usage con el recuento exacto de tokens para esa solicitud, incluyendo un desglose de image_tokens para entradas multimodales, para que pueda verificar el costo por llamada.
¿Ofrecen modelos para insertar imágenes, audio o vídeo?
keyboard_arrow_down
Sí. jina-embeddings-v5-omni-small y jina-embeddings-v5-omni-nano incrustan texto, imágenes, audio, vídeo y PDF en un único espacio vectorial compartido. jina-embeddings-v4 y jina-clip-v2 manejan texto e imágenes.
¿Es posible ajustar los modelos de embedding de Jina con datos privados o de la empresa?
keyboard_arrow_down
Existen dos opciones. La primera es la API de ajuste fino, que genera datos de entrenamiento sintéticos a partir de la descripción de su dominio y devuelve un modelo ajustado, sin necesidad de que cree un conjunto de datos etiquetados. Para el ajuste fino de datos propietarios bajo un acuerdo comercial, en infraestructura dedicada o en un modelo que no se encuentra en el selector de modelos base, póngase en contacto con Elastic Sales; dicho trabajo se define y contrata a través de Elastic.
Contacto
¿Se pueden alojar los modelos de forma privada, en mi propia infraestructura o en mi propia cuenta en la nube?
keyboard_arrow_down
Sí, de dos maneras. Los modelos Jina están disponibles en los marketplaces de AWS, Azure y GCP, por lo que puede implementarlos en su propia cuenta en la nube. Para infraestructuras autogestionadas, locales o aisladas, Elastic vende una licencia comercial llamada Jina On-Prem, disponible desde el 10 de agosto de 2026, que incluye los modelos como contenedores Docker totalmente offline, sin llamadas externas ni servidor de licencias. Para obtener un presupuesto para cualquiera de las dos opciones, póngase en contacto con Elastic Sales.
launchAWS SageMakerlaunchGoogle CloudlaunchMicrosoft Azure
¿Qué es el parámetro 'tarea' y cuándo debo usarlo?
keyboard_arrow_down
El parámetro task selecciona un adaptador LoRA específico para la tarea para un rendimiento óptimo. Utilice retrieval.query para consultas de búsqueda, retrieval.passage para documentos que se buscan, text-matching para similitud simétrica como detección de duplicados o paráfrasis, classification para categorización y separation para agrupamiento. La recuperación es asimétrica, por lo que usar el lado incorrecto del par consulta/pasaje degrada notablemente los resultados. El parámetro es compatible con jina-embeddings-v5, jina-embeddings-v4 y jina-embeddings-v3.
¿Qué es la recuperación de interacción tardía y qué modelos la admiten?
keyboard_arrow_down
La interacción tardía mantiene vectores a nivel de token en lugar de colapsar un documento en un solo vector, lo que preserva detalles finos a costa de un índice más grande. jina-embeddings-v4 admite salida densa (vector único) e interacción tardía (múltiples vectores) a través del parámetro output_type, y jina-colbert-v2 es un modelo dedicado a la interacción tardía. Para la mayoría de los pipelines de recuperación, un modelo v5 denso seguido de un reranker ofrece una mejor relación precisión/costo.
¿Qué es la segmentación tardía y cuándo debo utilizarla?
keyboard_arrow_down
La segmentación tardía primero integra todo el documento con un modelo de contexto extenso y luego deriva las representaciones de los fragmentos a partir de las representaciones a nivel de token. A diferencia de la segmentación ingenua, que integra cada fragmento de forma aislada, la segmentación tardía conserva el contexto entre fragmentos, lo que mejora la calidad de la recuperación en los pipelines RAG donde un fragmento hace referencia a algo definido anteriormente en el documento. Habilítela con el parámetro late_chunking.
¿Por qué la API impone una longitud de contexto diferente a la que admite el modelo?
keyboard_arrow_down
Algunos modelos son capaces de manejar contextos más largos de lo que acepta la API alojada. Las secuencias muy largas consumen una cantidad considerable de memoria de GPU, y ajustamos la configuración del servidor para equilibrar el rendimiento, la latencia y el costo en la mayoría de los casos de uso. Si necesita la longitud completa del contexto arquitectónico, ejecute el modelo usted mismo: póngase en contacto con Elastic Sales para obtener información sobre una implementación autogestionada.
¿Por qué jina-embeddings-v4 es gratuito y por qué es lento?
keyboard_arrow_down
jina-embeddings-v4 se basa en el modelo base Qwen2-VL, publicado bajo la Licencia de Investigación Qwen, que permite únicamente investigación y uso no comercial. Por lo tanto, no podemos licenciarlo comercialmente y lo proporcionamos de forma gratuita a través de la API. También es un modelo de 3,8 mil millones de parámetros, por lo que es inherentemente más lento por solicitud, y limitamos su rendimiento para gestionar los costos de infraestructura. No es adecuado para cargas de trabajo de producción, y por la misma razón no se ofrece a través del Servicio de Inferencia Elástica ni como parte de Jina On-Prem. Para uso en producción, utilice la familia jina-embeddings-v5: es más rápido, tiene un mejor rendimiento en las pruebas de recuperación y se puede licenciar para uso comercial a través de Elastic Sales.
¿Cuáles son los límites de velocidad para la API de embeddings?
keyboard_arrow_down
Los límites de velocidad dependen del tipo de clave API:

Gratis: 100 RPM, 100K TPM
De pago: 500 RPM, 2M TPM
Premium: 5.000 RPM, 50M TPM

Existe un límite adicional basado en IP de 10.000 solicitudes cada 60 segundos para evitar abusos. Los límites se aplican por clave y se cuentan en una ventana de 60 segundos, por lo que las ráfagas se suavizan en lugar de ponerse en cola; una solicitud que supere el límite devuelve HTTP 429 y debe reintentarse con retroceso exponencial. Si necesita límites más allá del nivel Premium, o capacidad dedicada sin ningún límite de inquilino compartido, póngase en contacto con Elastic Sales.
¿Qué modelo de embedding debo elegir?
keyboard_arrow_down
Comience con jina-embeddings-v5-text-small para la recuperación de texto: es el modelo sub-1B más robusto que ofrecemos y maneja 32K de contexto. Cambie a jina-embeddings-v5-text-nano cuando la latencia, el costo o el hardware de borde sean más importantes que el último punto de precisión. Use jina-embeddings-v5-omni-small o v5-omni-nano cuando se trate de imágenes, audio, vídeo o PDF; su salida de texto es idéntica al modelo de texto correspondiente, por lo que puede agregar modalidades a un índice existente sin volver a incrustar. Use jina-code-embeddings-0.5b o 1.5b para el código fuente. Dentro de una familia, cuanto más reciente, mejor.
¿Cuáles son los límites de tamaño de archivo para imágenes y archivos PDF?
keyboard_arrow_down
El tamaño máximo de archivo es de 5 MB para imágenes y 8 MB para archivos PDF. Los archivos de mayor tamaño serán rechazados con un error.
Preguntas comunes relacionadas con el reranker
¿Cuánto cuesta la API de Reranker?
keyboard_arrow_down
El precio de la API de Reranker sigue la misma estructura basada en tokens que la API de Embeddings, y los tokens se comparten entre todas las API de Jina con la misma clave. Las nuevas claves de API incluyen tokens gratuitos para empezar; además, se pueden adquirir paquetes de tokens. Consulta la sección de precios para obtener más información.
¿Cuáles son las diferencias entre los rerankers de Jina?
keyboard_arrow_down
jina-reranker-v3.5 es nuestro producto estrella actual: un reranker multilingüe listwise con 0,6 mil millones de parámetros y un contexto de 131.000 tokens, y un reemplazo directo para jina-reranker-v3. Mejora la versión 3 en todos los ejes que medimos, con las mayores ganancias en datos estructurados y recuperación legal, y se ejecuta de 1,22× a 1,56× más rápido. jina-reranker-v3 sigue disponible. jina-reranker-m0 es el reranker multimodal para clasificar documentos visuales. jina-reranker-v2-base-multilingual es un codificador cruzado más pequeño que admite más de 100 idiomas, útil cuando se necesita un modelo no derivado de Qwen. jina-colbert-v2 utiliza interacción tardía en 89 idiomas.
¿Cómo se obtienen las licencias para los rerankers de Jina?
keyboard_arrow_down
jina-reranker-v3.5, jina-reranker-v3, jina-reranker-m0, jina-reranker-v2-base-multilingual y jina-colbert-v2 se publican bajo la licencia CC-BY-NC 4.0. Puede utilizarlos, compartirlos y adaptarlos libremente para fines no comerciales. El uso comercial en producción requiere una licencia comercial, que Elastic ha vendido como su propio SKU desde el 10 de agosto de 2026 bajo el nombre Jina On-Prem. Póngase en contacto con Elastic Sales para obtener un presupuesto. Los modelos heredados jina-reranker-v1-* siguen siendo Apache-2.0.
¿Los rerankers admiten varios idiomas?
keyboard_arrow_down
Sí, todos los rerankers actuales son multilingües. jina-reranker-v3.5 mejora la versión 3 en MIRACL y en la recuperación multilingüe en general. jina-reranker-v3 y jina-reranker-v2-base-multilingual admiten más de 100 idiomas, jina-reranker-m0 maneja la clasificación visual de documentos multilingües y jina-colbert-v2 admite 89 idiomas.
¿Cuál es la longitud máxima del contexto para cada reranker?
keyboard_arrow_down
La longitud del contexto varía según el modelo:

jina-reranker-v3.5: 131.072 tokens (consulta más todos los documentos combinados) con truncamiento automático
jina-reranker-v3: 131.072 tokens con truncamiento automático
jina-reranker-m0: 10.000 tokens
jina-reranker-v2-base-multilingual: 1.024 tokens, con fragmentación automática para documentos más largos
jina-colbert-v2: 8.192 tokens

Para los rerankers v1 y v2, las consultas se truncan automáticamente y los documentos largos se fragmentan con max-pooling en todos los fragmentos.
¿Existe un límite en la cantidad de documentos que puedo reordenar por consulta?
keyboard_arrow_down
No hay un límite estricto en la cantidad de documentos por solicitud. Al igual que nuestra API de embeddings, la API de reranking agrupa las entradas internamente por número de tokens para optimizar el uso de la GPU. Puede enviar tantos documentos como necesite en una sola solicitud.
¿Qué latencia puedo esperar al reordenar 100 documentos?
keyboard_arrow_down
La latencia varía de 100 milisegundos a 7 segundos, dependiendo en gran medida de la longitud de los documentos y de la consulta. Por ejemplo, reordenar 100 documentos de 256 tokens cada uno con una consulta de 64 tokens lleva unos 150 milisegundos. Aumentar la longitud del documento a 4096 tokens aumenta el tiempo a 3,5 segundos. Si la longitud de la consulta aumenta a 512 tokens, el tiempo aumenta aún más a 7 segundos.
A continuación se muestra el costo de tiempo de reordenar una consulta y 100 documentos en milisegundos:
Número de tokens en cada documento
Número de tokens en la consulta256512102420484096
64156323136621073571
128194369137721233598
256273475139721554299
5124681385211435367068
¿Se pueden alojar los sistemas de reranking de forma privada, en mi propia infraestructura o en mi propia cuenta en la nube?
keyboard_arrow_down
Sí. Los rerankers están disponibles en los marketplaces de AWS, Azure y GCP para su implementación en su propia cuenta en la nube. Para infraestructuras autogestionadas, locales o aisladas, Elastic vende una licencia comercial (Jina On-Prem) que distribuye los modelos como contenedores Docker completamente offline. Póngase en contacto con Elastic Sales para obtener un presupuesto.
launchAWS SageMakerlaunchGoogle CloudlaunchMicrosoft Azure
¿Ofrecen algún sistema de reranking optimizado con datos específicos del dominio?
keyboard_arrow_down
Antes de solicitar un ajuste fino, pruebe jina-reranker-v3.5: se entrenó con autodestilación específicamente para la robustez del dominio y muestra grandes mejoras en la recuperación de datos legales y estructurados con respecto a la versión 3. Un reranker comercial bien elegido, junto con una mejor segmentación, suele cerrar más la brecha que un ajuste fino, y no tiene costo probarlo. Si aún así no cumple con sus expectativas para sus datos, un reranker específico del dominio es un servicio personalizado: comuníquese con Elastic Sales para definir el alcance.
Contacto
¿Cuál es el tamaño mínimo de imagen para los documentos?
keyboard_arrow_down
El tamaño de imagen mínimo aceptable para el modelo jina-reranker-m0 es 28x28 píxeles.
¿Qué es el reranking por listas y en qué se diferencia del reranking por puntos?
keyboard_arrow_down
jina-reranker-v3 y jina-reranker-v3.5 utilizan una arquitectura basada en listas: la consulta y todos los candidatos comparten una ventana de contexto y se puntúan en una única pasada hacia adelante, de modo que el modelo puede comparar los documentos entre sí. Los rerankers tradicionales basados ​​en puntos, incluido jina-reranker-v2-base-multilingual, puntúan cada documento de forma independiente con respecto a la consulta. La puntuación basada en listas es más precisa porque la relevancia suele ser relativa a lo que hay en el conjunto de candidatos.
¿Por qué la API impone una longitud de contexto diferente a la que admite el modelo?
keyboard_arrow_down
Algunos algoritmos de reordenamiento son capaces, desde el punto de vista arquitectónico, de manejar contextos más largos de los que admite la API alojada. Las secuencias muy largas consumen una cantidad considerable de memoria de GPU, por lo que ajustamos la configuración de servicio para equilibrar el rendimiento, la latencia y el coste en la mayoría de los casos de uso. Si necesita la longitud total del contexto arquitectónico, ejecute el modelo en su propia infraestructura y póngase en contacto con Elastic Sales para obtener una licencia comercial.
¿Cuáles son los límites de velocidad para la API de Reranker?
keyboard_arrow_down
Los límites de velocidad dependen del tipo de clave API:

Gratis: 100 RPM, 100K TPM
De pago: 500 RPM, 2M TPM
Premium: 5.000 RPM, 50M TPM

También hay un límite basado en IP de 10.000 solicitudes por 60 segundos. Los mismos límites se aplican a las API de Embeddings y Reranker, y los tokens se comparten entre todas las API de Jina en la misma clave.
¿Qué reranker debo elegir?
keyboard_arrow_down
Utilice jina-reranker-v3.5 para texto. Es un reemplazo directo para jina-reranker-v3: el esquema de solicitud no cambia, por lo que cambiar la cadena del modelo es toda la migración. Utilice jina-reranker-m0 cuando sus candidatos sean imágenes o documentos visualmente ricos. Utilice jina-reranker-v2-base-multilingual cuando necesite un modelo más pequeño o uno que no derive de una estructura base Qwen.
Preguntas comunes relacionadas con API
code
¿Puedo usar la misma clave API en todas las API de Jina?
keyboard_arrow_down
Sí. Una clave API es válida para todos los productos de la plataforma de búsqueda Jina AI, incluidas las API de Reader, Embeddings, Reranker, Classifier y Segmenter, y los tokens se comparten entre todos ellos.
code
¿Puedo monitorear el uso del token de mi clave API?
keyboard_arrow_down
Sí, el uso de tokens se puede monitorear en la pestaña "Clave API y facturación" ingresando su clave API, lo que le permite ver el historial de uso reciente y los tokens restantes. Si ha iniciado sesión en el panel de API, estos detalles también se pueden ver en la pestaña "Administrar clave API".
code
¿Qué debo hacer si olvido mi clave API?
keyboard_arrow_down
Si ha perdido una clave recargada y desea recuperarla, escriba a support AT jina.ai desde su correo electrónico registrado para recibir asistencia. Se recomienda iniciar sesión para mantener su clave API almacenada de forma segura y de fácil acceso.
Contacto
code
¿Caducan las claves API?
keyboard_arrow_down
No, nuestras claves API no tienen fecha de caducidad. Si una clave se ve comprometida, revócala en el panel de administración de claves API; el cambio surtirá efecto de inmediato. Emite primero una clave de reemplazo si desea evitar el tiempo de inactividad. Cualquier saldo de tokens restante permanece en su cuenta y no en la clave revocada. Si no puede acceder al panel de control o crea que la cuenta está comprometida, comunícate con el Soporte de Elastic.
Contacto
code
¿Puedo transferir tokens entre claves API?
keyboard_arrow_down
Sí, puede transferir tokens de una clave premium a otra. Después de iniciar sesión en su cuenta en el panel de administración de claves API, use la configuración de la clave que desea transferir para mover todos los tokens pagos restantes.
code
¿Puedo revocar mi clave API?
keyboard_arrow_down
Sí, puede revocar su clave API si crea que se ha visto comprometida. Al revocar una clave, se deshabilitará de inmediato para todos los usuarios que la hayan almacenado, y todo el saldo restante y las propiedades asociadas quedarán inutilizables de forma permanente. Si la clave es una clave premium, tiene la opción de transferir el saldo restante pagado a otra clave antes de la revocación. Tenga en cuenta que esta acción no se puede deshacer. Para revocar una clave, vaya a la configuración de claves en el panel de control de administración de claves API.
code
¿Por qué la primera solicitud de algunos modelos es lenta?
keyboard_arrow_down
Esto se debe a que nuestra arquitectura sin servidor retira ciertos modelos durante períodos de bajo uso. La solicitud inicial activa o "calienta" el modelo, lo que puede tardar unos segundos. Después de esta activación inicial, las solicitudes posteriores se procesan mucho más rápido.
code
¿Se utilizan mis datos de API para entrenar sus modelos?
keyboard_arrow_down
No. Nunca utilizamos sus solicitudes a la API, entradas o salidas para entrenar nuestros modelos de embedding, reranker u otros modelos. Sus datos siguen siendo suyos.
code
¿Cuáles son los límites de velocidad para las API de Jina?
keyboard_arrow_down
Se aplican límites de velocidad por clave API:

Gratis: 100 RPM, 100K TPM
De pago: 500 RPM, 2M TPM
Premium: 5.000 RPM, 50M TPM

También hay un límite basado en IP de 10.000 solicitudes cada 60 segundos. Los límites varían según el punto final; consulte la tabla de límites de velocidad anterior para obtener las cifras por punto final.
code
¿Existen límites de tamaño de lote para las API?
keyboard_arrow_down
No hay límite de tamaño de lote ni para la API de Embeddings ni para la de Reranker. Puede enviar tantos elementos o documentos como necesite por solicitud. Ambas API procesan las entradas internamente por lotes según el número de tokens para optimizar el uso de la GPU.
code
¿Las API de Jina son lo mismo que los modelos de Jina dentro de Elastic?
keyboard_arrow_down
No, son tres rutas separadas. Las API de Jina en este sitio son de autoservicio y de pago por uso con una clave de API de Jina. El Servicio de Inferencia Elástica (EIS) ejecuta modelos de Jina dentro de Elastic Cloud, facturado a través de su suscripción a Elastic, sin infraestructura que tenga que administrar. Jina On-Prem es una licencia comercial, vendida por Elastic como su propio SKU desde el 10 de agosto de 2026, para ejecutar los modelos en su propia infraestructura autogestionada, local o aislada. Para las rutas EIS y On-Prem, comuníquese con Ventas de Elastic.
Preguntas comunes relacionadas con la facturación
attach_money
¿La facturación se basa en el número de oraciones o solicitudes?
keyboard_arrow_down
Nuestro modelo de precios se basa en la cantidad total de tokens procesados, lo que permite a los usuarios la flexibilidad de asignar estos tokens en cualquier cantidad de oraciones, ofreciendo una solución rentable para diversos requisitos de análisis de texto.
attach_money
¿Hay una prueba gratuita disponible para nuevos usuarios?
keyboard_arrow_down
Sí. Los nuevos usuarios reciben una clave API generada automáticamente con tokens gratuitos que pueden usar en cualquiera de nuestros modelos. Una vez que se agoten los tokens gratuitos, pueden comprar tokens adicionales para la clave en la pestaña "Comprar tokens".
attach_money
¿Se cobran tokens por solicitudes fallidas?
keyboard_arrow_down
No, los tokens no se deducen por solicitudes fallidas.
attach_money
¿Qué métodos de pago se aceptan?
keyboard_arrow_down
Los pagos se procesan a través de Stripe y admiten una variedad de métodos de pago que incluyen tarjetas de crédito, Google Pay y PayPal para su comodidad.
attach_money
¿Está disponible la facturación para compras de tokens?
keyboard_arrow_down
Para las compras de tokens de autoservicio, Stripe emite una factura a la dirección de correo electrónico asociada a su cuenta de Stripe en el momento de la compra. Si necesita una orden de compra formal, un contrato negociado, documentación de adquisición o facturación consolidada, que se gestione a través de Elastic en lugar de Stripe, póngase en contacto con Elastic Sales.
attach_money
¿Cómo puedo comprar una licencia comercial en lugar de tokens API?
keyboard_arrow_down
Las compras de tokens en este sitio cubren el uso de las API de Jina alojadas. No otorgan licencia para ejecutar los pesos del modelo en su propia infraestructura. Para ello, Elastic vende una licencia comercial como su propio SKU desde el 10 de agosto de 2026, con un precio anual en lugar de por token. Contacte con Elastic Sales para obtener un presupuesto.
attach_money
¿Puedo pagar con factura o con orden de compra en lugar de con tarjeta?
keyboard_arrow_down
Las compras de tokens de autoservicio se procesan a través de Stripe y se facturan automáticamente al correo electrónico de su cuenta de Stripe. Para órdenes de compra, procesos de adquisición o volúmenes que superen lo que admite la recarga de autoservicio, póngase en contacto con Elastic Sales.
attach_money
Realicé el pago, pero mi saldo o límite de velocidad no ha cambiado. ¿Qué debo revisar?
keyboard_arrow_down
El saldo y los límites de tarifa pertenecen a una clave API, no a la cuenta, por lo que lo primero que debe verificar es la clave en sí, en lugar de la página de la cuenta: introdúzcala en la pestaña Clave API y facturación y confirme el saldo y el nivel allí. Si la cuenta tiene más de una clave, los tokens están en la clave que se recargó, que puede no ser la clave que envía su aplicación. Un nuevo nivel también puede tardar un poco en propagarse después del pago. Si la clave muestra el saldo pero sigue limitada al nivel anterior, póngase en contacto con el soporte técnico.
attach_money
¿Cómo puedo cancelar, detener la recarga automática o eliminar un método de pago guardado?
keyboard_arrow_down
La facturación de autoservicio se gestiona desde el portal del cliente, al que se accede a través de la pestaña Clave API y Facturación. Allí se puede desactivar la recarga automática y eliminar los métodos de pago guardados. Al desactivar la recarga automática, se detienen los cargos futuros, pero el saldo ya comprado permanece disponible. Si también desea eliminar la cuenta y sus datos, o solicitar un reembolso, envíe su solicitud al servicio de asistencia. La eliminación de la cuenta se realiza manualmente y tarda algunos días hábiles. Recibirá una confirmación por escrito una vez finalizado el proceso.
Idioma / tema actual
Search Foundation
Reader
Embeddings
Reranker
Obtener la clave API de Jina
Límite de velocidad
Sobre nosotros
Noticias
Descargar el logotipo de Jina
open_in_new
Descargar el logotipo de Elastic
open_in_new
Estado de la API
Elastic © 2026.SeguridadTérminos y condicionesPrivacidadAdministrar cookiesNo venda ni comparta mi información personal.
Este sitio web y su contenido, software, productos y servicios asociados están destinados exclusivamente a un uso profesional. El uso por parte de consumidores no está previsto ni dirigido.