Elastic
Jina AI
Modèles
API
keyboard_arrow_down
Lecteur
Lisez les URL et effectuez des recherches sur le Web pour de meilleurs LLM de base.
Intégrations
Intégrations multimodales et multilingues.
Reclasseur
Outil de reclassement pour optimiser la pertinence des résultats de recherche.
Elastic Inference Service
Exécutez les modèles Jina nativement au sein d'Elasticsearch.
MCP
terminal
CLI
article
llms.txt
smart_toy
Agents
data_object
Schéma
menu_book
Documents
Se connecter
login

Reclasseur

Optimisez la pertinence de la recherche et la précision du RAG avec notre API de reranker de pointe.

API de reclassement

Essayez notre API de reclassement de pointe pour maximiser la pertinence de votre recherche et la précision de RAG. Commencer gratuitement !
keyClé API et facturation
codeUsage
more_horizPlus
chevron_leftchevron_right

home
speedLimite de taux
bug_reportSoulever un problème
help_outlineFAQ
Statut
chevron_leftchevron_right

Nombre de documents retournés
top_n
top_k
Nombre maximal de documents les mieux classés à renvoyer.

upload
Demande
POST
curl "https://api.jina.ai/v1/rerank" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $JINA_API_KEY" \
-d @- <<EOFEOF
{ "model": null, "query": "Organic skincare products for sensitive skin", "top_n": 3, "documents": [ text_fieldsclose"Organic skincare for sensitive skin with aloe vera and chamomile: Imagine the soothing embrace of na…ing, healthy complexion.", text_fieldsclose"New makeup trends focus on bold colors and innovative techniques: Step into the world of cutting-edg…atement with every look.", text_fieldsclose"Bio-Hautpflege für empfindliche Haut mit Aloe Vera und Kamille: Erleben Sie die wohltuende Wirkung u…einen strahlenden Teint.", text_fieldsclose"Neue Make-up-Trends setzen auf kräftige Farben und innovative Techniken: Tauchen Sie ein in die Welt…jedes Mal ein Statement.", text_fieldsclose"Cuidado de la piel orgánico para piel sensible con aloe vera y manzanilla: Descubre el poder de la n…el radiante y saludable.", text_fieldsclose"Las nuevas tendencias de maquillaje se centran en colores vivos y técnicas innovadoras: Entra en el … y destaca en cada look.", text_fieldsclose"针对敏感肌专门设计的天然有机护肤产品:体验由芦荟和洋甘菊提取物带来的自然呵护。我们的护肤产品特别为敏感肌设计,温和滋润,保护您的肌肤不受刺激。让您的肌肤告别不适,迎来健康光彩。", text_fieldsclose"新的化妆趋势注重鲜艳的颜色和创新的技巧:进入化妆艺术的新纪元,本季的化妆趋势以大胆的颜色和创新的技巧为主。无论是霓虹眼线还是全息高光,每一款妆容都能让您脱颖而出,展现独特魅力。", text_fieldsclose"敏感肌のために特別に設計された天然有機スキンケア製品: アロエベラとカモミールのやさしい力で、自然の抱擁を感じてください。敏感肌用に特別に設計された私たちのスキンケア製品は、肌に優しく栄養を与え、保護します。肌トラブルにさようなら、輝く健康な肌にこんにちは。", text_fieldsclose"新しいメイクのトレンドは鮮やかな色と革新的な技術に焦点を当てています: 今シーズンのメイクアップトレンドは、大胆な色彩と革新的な技術に注目しています。ネオンアイライナーからホログラフィックハイライターまで、クリエイティビティを解き放ち、毎回ユニークなルックを演出しましょう。" + ajouter une entrée ], "return_documents": false }
EOFEOF


v3.5 : Réorganisation des listes plus rapide grâce à l’attention hybride et à l’auto-distillation

jina-reranker-v3.5 is a 0.6B parameter multilingual listwise reranker with a 131K context window. Hybrid attention and self-distillation make it both faster and more robust across domains than v3, and it is a drop-in replacement: the request schema is unchanged.
Lire la note de publicationarrow_forward

m0 : Reclasseur de documents multilingues et multimodaux

Notre nouveau reranker multimodal multilingue pour récupérer des documents visuels dans plusieurs langues, avec des performances SOTA sur les documents longs multilingues et les tâches de recherche de code.
Lire la note de publicationarrow_forward

Qu'est-ce qu'un reranker ?

L’objectif d’un système de recherche est de trouver les résultats les plus pertinents rapidement et efficacement. Traditionnellement, des méthodes telles que BM25 ou tf-idf ont été utilisées pour classer les résultats de recherche en fonction de la correspondance des mots clés. Des méthodes récentes, telles que la similarité cosinus basée sur l'intégration, ont été implémentées dans de nombreuses bases de données vectorielles. Ces méthodes sont simples mais peuvent parfois passer à côté des subtilités du langage et, plus important encore, de l'interaction entre les documents et l'intention d'une requête. C'est là que le « reranker » brille. Un reranker est un modèle d'IA avancé qui prend l'ensemble initial de résultats d'une recherche (souvent fourni par une recherche basée sur des intégrations/jetons) et les réévalue pour s'assurer qu'ils correspondent plus étroitement à l'intention de l'utilisateur. Il va au-delà de la correspondance superficielle des termes pour considérer l’interaction plus profonde entre la requête de recherche et le contenu des documents.
account_tree
Voici comment cela fonctionne:

1
Récupération initiale
Un système de recherche utilise embeddings/BM25 pour trouver un large ensemble de documents potentiellement pertinents en fonction de la requête de l'utilisateur.

2
Reclassement
Le reranker prend ensuite ces résultats et les analyse à un niveau plus granulaire, en tenant compte des nuances de la manière dont les termes de requête interagissent avec le contenu du document.

3
Résultats améliorés
Il réorganise les résultats de recherche, en plaçant ceux qu'il juge les plus pertinents en haut, sur la base de cette analyse plus approfondie.

Le reranker peut améliorer considérablement la qualité de la recherche car il opère au niveau des sous-documents et des sous-requêtes, ce qui signifie qu'il examine les mots et expressions individuels, leur signification et leurs relations les uns avec les autres dans la requête et les documents. Cela se traduit par un ensemble de résultats de recherche plus précis et contextuellement pertinents.
Jina Reranker v2 est un outil de reclassement sorti le 25 juin 2024 ; il est conçu pour Agentic RAG. Il prend en charge les appels de fonctions, la recherche multilingue pour plus de 100 langues, la recherche de code et offre une vitesse six fois supérieure à celle de la version 1. En savoir plus sur le modèle v2.
Récupération multilingue
Reranker v2 permet la récupération de documents dans plus de 100 langues, quel que soit le langage de requête.

Appel de fonction et recherche de code
Reranker v2 classe les extraits de code et les signatures de fonctions en fonction de requêtes en langage naturel, idéal pour les applications Agentic RAG.

Prise en charge des données tabulaires et structurées
Reranker v2 classe les tables les plus pertinentes en fonction de requêtes en langage naturel, aidant ainsi à trier différents schémas de table et à identifier le plus pertinent avant de générer une requête SQL.

Deux façons d'acheter

Abonnez-vous à notre API ou achetez via des fournisseurs de cloud.
radio_button_unchecked
cloud
Avec 3 fournisseurs de services cloud
Votre entreprise utilise-t-elle AWS ou Azure ? Déployez ensuite directement nos modèles de fondation de recherche sur ces plateformes dans votre entreprise, afin que vos données restent sécurisées et conformes.
AWS SageMaker
Intégrations
Reclasseur
Microsoft Azure
Intégrations
Reclasseur
Google Cloud
Intégrations
radio_button_checked
Avec l'API Jina Search Foundation
Le moyen le plus simple d'accéder à tous nos produits. Rechargez vos jetons au fur et à mesure.
Rechargez cette clé API avec plus de jetons
Selon votre emplacement, vous pouvez être facturé en USD, EUR ou dans d'autres devises. Des taxes peuvent s'appliquer.
Veuillez saisir la bonne clé API pour recharger
Comprendre la limite de débit
Les limites de débit correspondent au nombre maximal de requêtes pouvant être adressées à une API en une minute par adresse IP/clé API (RPM). Découvrez ci-dessous les limites de débit pour chaque produit et niveau.
keyboard_arrow_down
Limite de taux
Les limites de débit sont suivies de trois manières : RPM (requêtes par minute) et TPM (jetons par minute). Les limites sont appliquées par IP/clé API et sont déclenchées dès que le seuil RPM ou TPM est atteint. Lorsque vous fournissez une clé API dans l'en-tête de la requête, nous suivons les limites de débit par clé plutôt que par adresse IP.
ProduitPoint de terminaison de l'APIDescriptionarrow_upwardsans clé APIkey_offavec clé API gratuitekeyavec clé API payantekeyavec clé API PremiumkeyLatence moyenneComptage de l'utilisation des jetonsDemande autorisée
API de lecteurhttps://r.jina.aiConvertir l'URL en texte compatible LLM20 RPM500 RPM500 RPMtrending_up5000 RPM7.9sComptez le nombre de jetons dans la réponse de sortie.GET/POST
API de lecteurhttps://s.jina.aiRecherchez sur le Web et convertissez les résultats en texte adapté au LLMblock100 RPM100 RPMtrending_up1000 RPM2.5sChaque demande coûte un nombre fixe de jetons, à partir de 10000 jetonsGET/POST
API d'intégrationhttps://api.jina.ai/v1/embeddingsConvertir du texte/des images en vecteurs de longueur fixeblock100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
dépend de la taille de l'entrée
help
Comptez le nombre de jetons dans la demande d'entrée.POST
API de reclassementhttps://api.jina.ai/v1/rerankClasser les documents par requêteblock100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
dépend de la taille de l'entrée
help
Comptez le nombre de jetons dans la demande d'entrée.POST

Déploiement sur site

Déployez Jina Reranker sur AWS Sagemaker et Microsoft Azure et bientôt dans Google Cloud Services, ou contactez notre équipe commerciale pour obtenir des déploiements Kubernetes personnalisés pour votre cloud privé virtuel et vos serveurs sur site.
AWS SageMaker
Intégrations
Reclasseur
Microsoft Azure
Intégrations
Reclasseur
Google Cloud
Intégrations

Comparaison de Reranker, Vector Search et BM25

Le tableau ci-dessous fournit une comparaison complète du Reranker, de la recherche Vector/Embeddings et du BM25, mettant en évidence leurs forces et leurs faiblesses dans diverses catégories.
ReclasseurRecherche de vecteursBM25
Meilleur pourPrécision et pertinence de recherche amélioréesFiltrage initial et rapideRécupération de texte générale pour des requêtes étendues
GranularitéDétaillé : sous-document et segment de requêteLarge : documents entiersIntermédiaire : divers segments de texte
Complexité du temps de requêteHautMoyenFaible
Complexité du temps d’indexationNon requisHautFaible, utilise un index prédéfini
Complexité du temps de formationHautHautNon requis
Qualité de la rechercheSupérieur pour les requêtes nuancéesÉquilibré entre efficacité et précisionCohérent et fiable pour un large éventail de requêtes
ForcesTrès précis avec une compréhension contextuelle approfondieRapide et efficace, avec une précision modéréeHautement évolutif, avec une efficacité établie
Essayez l'API de reclassement gratuitementEssayez d'intégrer l'API gratuitement

En savoir plus sur le Reranker

Qu'est-ce qu'un reranker ? Pourquoi la recherche vectorielle ou la similarité cosinus ne suffisent-elles pas ? Découvrez les rerankers de A à Z avec notre guide complet.
août 03, 2026 • 11 minutes lues
jina-reranker-v3.5: Faster Listwise Reranking with Hybrid Attention and Self-Distillation
A 0.6B listwise reranker that beats Qwen3-Reranker-4B on BEIR, reranks up to 1.56x faster than v3, and gains 9.6 nDCG@10 on semi-structured retrieval.
Jina AI
jina-reranker-v3.5: An Efficient Listwise Reranker with Hybrid Attention and Self-Distillation
juillet 20, 2026
jina-reranker-v3.5: An Efficient Listwise Reranker with Hybrid Attention and Self-Distillation
Listwise rerankers are the discriminative core of agentic retrieval pipelines, yet production deployment demands efficiency, domain robustness, and fluency on semi-structured data at the same time. We present jina-reranker-v3.5, a 0.6B-parameter listwise reranker that meets these demands together without sacrificing the cross-document comparison that makes its predecessor jina-reranker-v3 effective. It replaces uniform global attention with a hybrid schedule of three sliding-window layers followed by two global layers, pinning the terminal layer to global as last-but-not-late readout requires. It trains on a curated multi-domain mixture spanning legal, medical, financial, multilingual, and structured retrieval, and transfers quality through a three-stage self-distillation recipe in which a full-attention teacher sets an upper bound that a sparse-attention student then recovers. jina-reranker-v3.5 reaches 63.20 nDCG@10 on BEIR, matching a 4B model at roughly 7x fewer parameters, and lifts semi-structured retrieval by 9.6 nDCG@10 over jina-reranker-v3 while cutting listwise inference latency by up to 1.56x.
Light blue background with stylized text in the center, composed of small dots or squares, evoking a modern and minimalistic
octobre 03, 2025 • 7 minutes lues
Jina Reranker v3: 0.6B Listwise Reranker for SOTA Multilingual Retrieval
New 0.6B-parameter listwise reranker that considers the query and all candidate documents in a single context window.
Jina AI
jina-reranker-v3: Last but Not Late Interaction for Document Reranking
octobre 01, 2025
jina-reranker-v3: Last but Not Late Interaction for Document Reranking
jina-reranker-v3 is a 0.6B parameter multilingual document reranker that introduces a novel last but not late interaction. Unlike late interaction models such as ColBERT that perform separate encoding followed by multi-vector matching, our approach conducts causal self-attention between query and documents within the same context window, enabling rich cross-document interactions before extracting contextual embeddings from the last token of each document. This compact architecture achieves state-of-the-art BEIR performance with 61.94 nDCG@10 while being significant smaller than generative listwise rerankers.

FAQ

Combien coûte l’API Reranker ?
keyboard_arrow_down
La tarification de l'API Reranker suit la même structure de jetons que l'API Embeddings, et les jetons sont partagés entre toutes les API Jina utilisant la même clé. Les nouvelles clés API incluent des jetons gratuits pour démarrer ; ensuite, des packs de jetons sont disponibles à l'achat. Consultez la section Tarification pour plus de détails.
Quelles sont les différences entre les modérateurs de Jina ?
keyboard_arrow_down
jina-reranker-v3.5 est notre produit phare actuel : un réordonnanceur multilingue par liste de 0,6 milliard de paramètres avec 131 000 contextes, remplaçant directement jina-reranker-v3. Il améliore la version 3 sur tous les axes mesurés, avec les gains les plus importants en matière de données structurées et de recherche juridique, et est 1,22 à 1,56 fois plus rapide. jina-reranker-v3 reste disponible. jina-reranker-m0 est le réordonnanceur multimodal pour le classement des documents visuels. jina-reranker-v2-base-multilingual est un encodeur croisé plus léger prenant en charge plus de 100 langues, utile lorsque vous avez besoin d’un modèle non dérivé de Qwen. jina-colbert-v2 utilise l’interaction tardive dans 89 langues.
Comment les reclasseurs Jina obtiennent-ils leur licence ?
keyboard_arrow_down
Les modules jina-reranker-v3.5, jina-reranker-v3, jina-reranker-m0, jina-reranker-v2-base-multilingual et jina-colbert-v2 sont distribués sous licence CC-BY-NC 4.0. Vous êtes libre de les utiliser, de les partager et de les adapter à des fins non commerciales. Une utilisation commerciale en production nécessite une licence commerciale, qu'Elastic commercialise depuis le 10 août 2026 sous le nom de Jina On-Prem. Contactez le service commercial d'Elastic pour obtenir un devis. Les anciens modèles jina-reranker-v1-* restent sous licence Apache 2.0.
Les rerankers prennent-ils en charge plusieurs langues ?
keyboard_arrow_down
Oui, tous les outils de réordonnancement actuels sont multilingues. `jina-reranker-v3.5` améliore la version 3 pour MIRACL et la recherche multilingue en général. `jina-reranker-v3` et `jina-reranker-v2-base-multilingual` prennent en charge plus de 100 langues, `jina-reranker-m0` gère le classement visuel multilingue des documents et `jina-colbert-v2` prend en charge 89 langues.
Quelle est la longueur maximale du contexte pour chaque module de réorganisation ?
keyboard_arrow_down
La longueur du contexte varie selon le modèle :

jina-reranker-v3.5 : 131 072 jetons (requête et tous les documents combinés) avec troncature automatique
jina-reranker-v3 : 131 072 jetons avec troncature automatique
jina-reranker-m0 : 10 000 jetons
jina-reranker-v2-base-multilingual : 1 024 jetons, avec découpage automatique pour les documents longs
jina-colbert-v2 : 8 192 jetons

Pour les réorganisateurs v1 et v2, les requêtes sont tronquées automatiquement et les documents longs sont découpés en segments avec un regroupement maximal entre les segments.
Existe-t-il une limite au nombre de documents que je peux réorganiser par requête ?
keyboard_arrow_down
Il n'y a pas de limite stricte au nombre de documents par requête. À l'instar de notre API Embeddings, l'API Reranker regroupe les entrées en interne par nombre de jetons afin d'optimiser l'utilisation du GPU. Vous pouvez envoyer autant de documents que nécessaire en une seule requête.
À quelle latence puis-je m'attendre lors du reclassement de 100 documents ?
keyboard_arrow_down
La latence varie de 100 millisecondes à 7 secondes, en fonction en grande partie de la longueur des documents et de la requête. Par exemple, le reclassement de 100 documents de 256 jetons chacun avec une requête de 64 jetons prend environ 150 millisecondes. L'augmentation de la longueur du document à 4 096 jetons augmente le temps à 3,5 secondes. Si la longueur de la requête est augmentée à 512 jetons, le temps augmente encore à 7 secondes.
Vous trouverez ci-dessous le coût en temps nécessaire au reclassement d'une requête et de 100 documents en millisecondes :
Nombre de jetons dans chaque document
Nombre de jetons dans la requête256512102420484096
64156323136621073571
128194369137721233598
256273475139721554299
5124681385211435367068
Est-il possible d'héberger les outils de reclassement en mode privé, sur ma propre infrastructure ou dans mon propre compte cloud ?
keyboard_arrow_down
Oui. Les outils de réévaluation sont disponibles sur les places de marché AWS, Azure et GCP pour un déploiement dans votre propre compte cloud. Pour les infrastructures autogérées, sur site ou isolées du réseau, Elastic propose une licence commerciale (Jina On-Prem) qui fournit les modèles sous forme de conteneurs Docker entièrement hors ligne. Contactez le service commercial d'Elastic pour obtenir un devis.
launchAWS SageMakerlaunchGoogle CloudlaunchMicrosoft Azure
Proposez-vous un outil de reclassement optimisé sur des données spécifiques à un domaine ?
keyboard_arrow_down
Avant de commander un réglage fin, essayez jina-reranker-v3.5 : entraîné avec l'auto-distillation spécifiquement pour une robustesse accrue au sein du domaine, il affiche des gains significatifs en matière de recherche de données juridiques et structurées par rapport à la version 3. Un outil de reranking prêt à l'emploi bien choisi, associé à un meilleur découpage des données, permet généralement de combler davantage l'écart qu'un réglage fin, et son test est gratuit. Si les résultats ne sont toujours pas à la hauteur de vos données, un outil de reranking spécifique à votre domaine est une solution personnalisée : contactez Elastic Sales pour définir le périmètre de votre projet.
Contact
Quelle est la taille minimale de l'image pour les documents ?
keyboard_arrow_down
La taille d'image minimale acceptable pour le modèle jina-reranker-m0 est de 28x28 pixels.
Qu’est-ce que le réordonnancement par liste et en quoi diffère-t-il du réordonnancement par points ?
keyboard_arrow_down
Les modules `jina-reranker-v3` et `jina-reranker-v3.5` utilisent une architecture par liste : la requête et tous les candidats partagent une même fenêtre de contexte et sont évalués en une seule passe, permettant ainsi au modèle de comparer les documents entre eux. Les systèmes de réévaluation ponctuelle traditionnels, comme `jina-reranker-v2-base-multilingual`, évaluent chaque document indépendamment de la requête. L'évaluation par liste est plus précise car la pertinence est souvent relative aux autres éléments de l'ensemble des candidats.
Pourquoi l'API impose-t-elle une longueur de contexte différente de celle prise en charge par le modèle ?
keyboard_arrow_down
Certains systèmes de réordonnancement sont conçus pour gérer un contexte plus long que celui accepté par l'API hébergée. Les séquences très longues consomment une quantité importante de mémoire GPU ; nous optimisons donc la configuration de diffusion afin d'équilibrer débit, latence et coût pour la plupart des cas d'utilisation. Si vous avez besoin de la longueur complète du contexte architectural, exécutez le modèle sur votre propre infrastructure et contactez Service commercial d'Elastic pour obtenir une licence commerciale.
Quelles sont les limites de débit de l'API Reranker ?
keyboard_arrow_down
Les limites de débit dépendent du type de votre clé API :

Gratuite : 100 RPM, 100 000 TPM
Payante : 500 RPM, 2 millions TPM
Premium : 5 000 RPM, 50 millions TPM

Il existe également une limite de 10 000 requêtes par adresse IP et par période de 60 secondes. Ces mêmes limites s’appliquent aux API Embeddings et Reranker, et les jetons sont partagés entre toutes les API Jina utilisant la même clé.
Quel outil de reclassement dois-je choisir ?
keyboard_arrow_down
Utilisez `jina-reranker-v3.5` pour le traitement de texte. Ce module remplace directement `jina-reranker-v3` : le schéma de requête restant inchangé, la migration se limite donc au remplacement de la chaîne de modèle. Utilisez `jina-reranker-m0` lorsque vos candidats sont des images ou des documents riches en contenu visuel. Utilisez `jina-reranker-v2-base-multilingual` si vous avez besoin d'un modèle plus léger ou d'un modèle non basé sur Qwen.

Comment obtenir ma clé API ?

video_not_supported

Quelle est la limite de débit ?

Limite de taux
Les limites de débit sont suivies de trois manières : RPM (requêtes par minute) et TPM (jetons par minute). Les limites sont appliquées par IP/clé API et sont déclenchées dès que le seuil RPM ou TPM est atteint. Lorsque vous fournissez une clé API dans l'en-tête de la requête, nous suivons les limites de débit par clé plutôt que par adresse IP.
ProduitPoint de terminaison de l'APIDescriptionarrow_upwardsans clé APIkey_offavec clé API gratuitekeyavec clé API payantekeyavec clé API PremiumkeyLatence moyenneComptage de l'utilisation des jetonsDemande autorisée
API de lecteurhttps://r.jina.aiConvertir l'URL en texte compatible LLM20 RPM500 RPM500 RPMtrending_up5000 RPM7.9sComptez le nombre de jetons dans la réponse de sortie.GET/POST
API de lecteurhttps://s.jina.aiRecherchez sur le Web et convertissez les résultats en texte adapté au LLMblock100 RPM100 RPMtrending_up1000 RPM2.5sChaque demande coûte un nombre fixe de jetons, à partir de 10000 jetonsGET/POST
API d'intégrationhttps://api.jina.ai/v1/embeddingsConvertir du texte/des images en vecteurs de longueur fixeblock100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
dépend de la taille de l'entrée
help
Comptez le nombre de jetons dans la demande d'entrée.POST
API de reclassementhttps://api.jina.ai/v1/rerankClasser les documents par requêteblock100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
dépend de la taille de l'entrée
help
Comptez le nombre de jetons dans la demande d'entrée.POST

Ai-je besoin d’une licence commerciale ?

Auto-vérification de la licence CC BY-NC

play_arrow
Utilisez-vous notre API hébergée ou nos images officielles sur Azure, AWS ou GCP ?
play_arrow
Oui
Aucune licence supplémentaire n'est requise. L'utilisation commerciale est soumise aux conditions d'utilisation : inscrivez-vous et payez via ce site ou la plateforme cloud.
play_arrow
Non
play_arrow
Utilisez-vous vous-même les pondérations du modèle, dans un produit ou un service commercial ?
play_arrow
Non
Aucun achat requis. Le téléchargement, l'évaluation, l'analyse comparative et l'utilisation à des fins de recherche sont autorisés conformément à toutes les licences sous lesquelles nous publions, à condition d'en mentionner la source.
play_arrow
Oui
play_arrow
De quelle licence dispose le mannequin ? C’est indiqué sur sa page sur Hugging Face.
play_arrow
Apache-2.0
Apache 2.0 autorise l'utilisation commerciale. Aucun achat requis. Ceci couvre nos anciens modèles de génération v1 et v2.
play_arrow
CC BY-NC 4.0
Vous avez besoin d'une licence commerciale. Depuis le 10 août 2026, Elastic en propose une pour les modèles Jina sous la référence Jina On-Prem. Elle couvre les déploiements autogérés, sur site et isolés du réseau, et ne nécessite pas d'abonnement Elasticsearch.
Si vous êtes déjà client d'Elastic, votre équipe commerciale peut l'ajouter à votre contrat existant.
Contactez le service commercial d'Elastic
play_arrow
Licence de recherche Qwen
La licence de recherche n'autorise pas l'utilisation commerciale, et la licence commerciale de nos autres modèles ne s'applique pas à celui-ci. Aucune option commerciale n'est disponible pour ce modèle, que ce soit en auto-hébergement ou via l'API. Veuillez choisir un modèle sous l'une des deux autres licences.
Questions courantes liées à l'API
code
Puis-je utiliser la même clé API pour toutes les API Jina ?
keyboard_arrow_down
Oui. Une seule clé API est valable pour tous les produits de la plateforme de recherche Jina AI, y compris les API Reader, Embeddings, Reranker, Classifier et Segmenter, avec des jetons partagés entre eux.
code
Puis-je surveiller l’utilisation des jetons de ma clé API ?
keyboard_arrow_down
Oui, l'utilisation des jetons peut être surveillée dans l'onglet « Clé API et facturation » en saisissant votre clé API, ce qui vous permet d'afficher l'historique d'utilisation récent et les jetons restants. Si vous êtes connecté au tableau de bord de l'API, ces détails peuvent également être consultés dans l'onglet « Gérer la clé API ».
code
Que dois-je faire si j'oublie ma clé API ?
keyboard_arrow_down
Si vous avez égaré une clé rechargée et souhaitez la récupérer, veuillez contacter le support AT jina.ai avec votre adresse e-mail enregistrée pour obtenir de l'aide. Il est recommandé de vous connecter pour conserver votre clé API en toute sécurité et facilement accessible.
Contact
code
Les clés API expirent-elles ?
keyboard_arrow_down
Non, nos clés API n'ont pas de date d'expiration. Si une clé est compromise, révoquez-la vous-même depuis le tableau de bord de gestion des clés API. La révocation est immédiate. Pour éviter toute interruption de service, émettez d'abord une clé de remplacement. Le solde de jetons restant est conservé sur votre compte et non associé à la clé révoquée. Si vous ne pouvez pas accéder au tableau de bord ou si vous pensez que votre compte est compromis, contactez le support Elastic.
Contact
code
Puis-je transférer des jetons entre des clés API ?
keyboard_arrow_down
Oui, vous pouvez transférer des jetons d'une clé premium vers une autre. Après vous être connecté à votre compte sur le tableau de bord de gestion des clés API, utilisez les paramètres de la clé que vous souhaitez transférer pour déplacer tous les jetons payants restants.
code
Puis-je révoquer ma clé API ?
keyboard_arrow_down
Oui, vous pouvez révoquer votre clé API si vous pensez qu'elle a été compromise. La révocation d'une clé la désactivera immédiatement pour tous les utilisateurs qui l'ont stockée, et tout le solde restant et les propriétés associées seront définitivement inutilisables. Si la clé est une clé premium, vous avez la possibilité de transférer le solde restant payé vers une autre clé avant la révocation. Notez que cette action ne peut pas être annulée. Pour révoquer une clé, accédez aux paramètres de clé dans le tableau de bord de gestion des clés API.
code
Pourquoi la première demande de certains modèles est-elle lente ?
keyboard_arrow_down
Cela est dû au fait que notre architecture sans serveur décharge certains modèles pendant les périodes de faible utilisation. La requête initiale active ou « réchauffe » le modèle, ce qui peut prendre quelques secondes. Après cette activation initiale, les requêtes suivantes sont traitées beaucoup plus rapidement.
code
Mes données API sont-elles utilisées pour entraîner vos modèles ?
keyboard_arrow_down
Non. Nous n'utilisons jamais vos requêtes API, entrées ou sorties pour entraîner nos modèles d'embedding, de reranker ou tout autre modèle. Vos données vous appartiennent.
code
Quelles sont les limites de débit des API Jina ?
keyboard_arrow_down
Des limites de débit s'appliquent par clé API :

Gratuit : 100 RPM, 100 000 TPM
Payant : 500 RPM, 2 millions TPM
Premium : 5 000 RPM, 50 millions TPM

Une limite de 10 000 requêtes par 60 secondes est également appliquée par adresse IP. Les limites varient selon le point de terminaison ; consultez le tableau des limites de débit ci-dessus pour connaître les valeurs par point de terminaison.
code
Existe-t-il des limites de taille de lot pour les API ?
keyboard_arrow_down
Il n'y a aucune limite de taille de lot pour les API Embeddings et Reranker. Vous pouvez envoyer autant d'éléments ou de documents que nécessaire par requête. Les deux API traitent les entrées par lots en interne, en fonction du nombre de tokens, pour une utilisation optimale du GPU.
code
Les API Jina sont-elles la même chose que les modèles Jina au sein d'Elastic ?
keyboard_arrow_down
Non, il s'agit de trois solutions distinctes. Les API Jina disponibles sur ce site sont en libre-service et fonctionnent avec un paiement à l'utilisation via une clé API Jina. Elastic Inference Service (EIS) exécute les modèles Jina au sein d'Elastic Cloud et est facturé via votre abonnement Elastic, sans aucune infrastructure à gérer de votre part. Jina On-Prem est une licence commerciale, vendue par Elastic sous sa propre référence depuis le 10 août 2026, permettant d'exécuter les modèles dans votre propre infrastructure autogérée, sur site ou isolée du réseau. Pour les solutions EIS et On-Prem, veuillez contacter le service commercial d'Elastic.
Questions courantes liées à la facturation
attach_money
La facturation est-elle basée sur le nombre de phrases ou de demandes ?
keyboard_arrow_down
Notre modèle de tarification est basé sur le nombre total de jetons traités, ce qui donne aux utilisateurs la possibilité d'attribuer ces jetons à un nombre illimité de phrases, offrant ainsi une solution rentable pour diverses exigences d'analyse de texte.
attach_money
Existe-t-il un essai gratuit disponible pour les nouveaux utilisateurs ?
keyboard_arrow_down
Oui. Les nouveaux utilisateurs reçoivent une clé API générée automatiquement ainsi que des jetons gratuits utilisables avec tous nos modèles. Une fois ces jetons gratuits épuisés, vous pouvez en acheter d'autres pour cette clé dans l'onglet « Acheter des jetons ».
attach_money
Les jetons sont-ils facturés pour les demandes ayant échoué ?
keyboard_arrow_down
Non, les jetons ne sont pas déduits pour les demandes ayant échoué.
attach_money
Quels moyens de paiement sont acceptés ?
keyboard_arrow_down
Les paiements sont traités via Stripe, prenant en charge diverses méthodes de paiement, notamment les cartes de crédit, Google Pay et PayPal, pour votre commodité.
attach_money
La facturation est-elle disponible pour les achats de jetons ?
keyboard_arrow_down
Pour les achats de jetons en libre-service, Stripe envoie une facture à l'adresse e-mail associée à votre compte Stripe au moment de l'achat. Si vous avez besoin d'un bon de commande, d'un contrat négocié, de documents d'approvisionnement ou d'une facturation consolidée, traités par Elastic et non par Stripe : contactez le service commercial d'Elastic (https://www.elastic.co/contact).
attach_money
Comment puis-je acheter une licence commerciale plutôt que des jetons API ?
keyboard_arrow_down
L'achat de jetons sur ce site vous permet d'utiliser les API Jina hébergées. Il ne vous autorise pas à exécuter les poids du modèle sur votre propre infrastructure. Pour cela, Elastic propose une licence commerciale distincte depuis le 10 août 2026, facturée annuellement et non par jeton. Contactez le service commercial d'Elastic (https://www.elastic.co/contact) pour obtenir un devis.
attach_money
Puis-je payer par facture ou bon de commande plutôt que par carte ?
keyboard_arrow_down
Les achats de jetons en libre-service sont traités par Stripe et facturés automatiquement à l'adresse e-mail associée à votre compte Stripe. Pour les commandes, les processus d'approvisionnement ou les volumes supérieurs à la capacité de recharge en libre-service, veuillez contacter Elastic Sales.
attach_money
J'ai payé, mais mon solde ou ma limite de débit n'a pas changé. Que dois-je vérifier ?
keyboard_arrow_down
Le solde et les limites de débit sont liés à une clé API, et non au compte. Par conséquent, vérifiez d'abord la clé elle-même, et non la page du compte : saisissez-la dans l'onglet « Clé API et facturation » et vérifiez le solde et le niveau. Si le compte possède plusieurs clés, les jetons sont associés à la clé rechargée, qui peut différer de celle utilisée par votre application. La mise à jour du niveau peut prendre un peu de temps après le paiement. Si le solde affiché est correct mais que la limite reste celle du niveau précédent, contactez l'assistance.
attach_money
Comment puis-je annuler, arrêter le rechargement automatique ou supprimer un mode de paiement enregistré ?
keyboard_arrow_down
La facturation en libre-service est gérée depuis le portail client, accessible via l'onglet « Clé API et facturation ». Vous pouvez y désactiver le rechargement automatique et supprimer les moyens de paiement enregistrés. La désactivation du rechargement automatique empêche les prélèvements futurs, mais le solde déjà utilisé reste disponible. Si vous souhaitez également supprimer votre compte et ses données, ou demander un remboursement, veuillez adresser votre demande au support. La suppression de compte est traitée manuellement et prend quelques jours ouvrables. Vous recevrez une confirmation écrite une fois la suppression effectuée.
Langue / thème actuel
Search Foundation
Lecteur
Intégrations
Reclasseur
Obtenir la clé API Jina
Limite de taux
À propos de nous
Nouvelles
Télécharger le logo Jina
open_in_new
Télécharger le logo Elastic
open_in_new
Statut de l'API
Elastic © 2026.Sécuritétermes et conditionsConfidentialitéGérer les cookiesNe vendez ni ne partagez mes informations personnelles
Ce site web et l'ensemble de son contenu, logiciels, produits et services sont destinés exclusivement à un usage professionnel. Leur utilisation par les consommateurs n'est ni prévue ni autorisée.