Elastic
Jina AI
Modèles
API
keyboard_arrow_down
Reader
Convertissez n'importe quelle URL en Markdown pour un meilleur grounding des LLM.
Embeddings
Embeddings multimodales et multilingues.
Reclasseur
Outil de reclassement pour optimiser la pertinence des résultats de recherche.
MCP
terminal
CLI
article
llms.txt
smart_toy
Agents
data_object
Schéma
menu_book
Documents
Se connecter
login

Contacter le service commercial

Développez votre entreprise avec Jina AI.

nights_stay L'équipe commerciale est absente, de retour dans 53h

Deux façons d'acheter

Abonnez-vous à notre API ou achetez via des fournisseurs de cloud.
radio_button_unchecked
cloud
Avec 3 fournisseurs de services cloud
Votre entreprise utilise-t-elle AWS ou Azure ? Déployez nos modèles directement sur la plateforme cloud de votre entreprise et gérez la facturation via le compte CSP.
AWS SageMaker
Embeddings
Reranker
Microsoft Azure
Embeddings
Reranker
Google Cloud
Embeddings
radio_button_checked
Avec l'API Jina Search Foundation
Le moyen le plus simple d'accéder à tous nos produits. Rechargez vos tokens au fur et à mesure.
Rechargez cette clé API avec plus de tokens
Selon votre emplacement, vous pouvez être facturé en USD, EUR ou dans d'autres devises. Des taxes peuvent s'appliquer.
Veuillez saisir la bonne clé API pour recharger
Comprendre la limite de débit
Les limites de débit correspondent au nombre maximal de requêtes pouvant être adressées à une API en une minute par adresse IP/clé API (RPM). Découvrez ci-dessous les limites de débit pour chaque produit et niveau.
keyboard_arrow_down
Limite de débit
Les limites de débit sont suivies de deux manières : RPM (requêtes par minute) et TPM (tokens par minute). Les limites sont appliquées par IP/clé API et sont déclenchées dès que le seuil RPM ou TPM est atteint. Lorsque vous fournissez une clé API dans l'en-tête de la requête, nous suivons les limites de débit par clé plutôt que par adresse IP.
ProduitPoint de terminaison de l'APIDescriptionarrow_upwardsans clé APIkey_offavec clé API gratuitekeyavec clé API payantekeyavec clé API PremiumkeyLatence moyenneComptage de l'utilisation des tokensDemande autorisée
API de Readerhttps://r.jina.aiConvertir l'URL en texte compatible LLM20 RPM500 RPM500 RPMtrending_up5000 RPM7.9sCompter le nombre de tokens dans la réponse de sortie.GET/POST
API de Readerhttps://s.jina.aiRechercher sur le web et convertir les résultats en texte adapté au LLMblock100 RPM100 RPMtrending_up1000 RPM2.5sChaque demande coûte un nombre fixe de tokens, à partir de 10000 tokensGET/POST
API de reclassementhttps://api.jina.ai/v1/rerankClasser les documents par requêteblock100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
dépend de la taille de l'entrée
help
Compter le nombre de tokens dans la demande d'entrée.POST
API embeddingshttps://api.jina.ai/v1/embeddingsConvertir du texte/des images en vecteurs de longueur fixeblock100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
dépend de la taille de l'entrée
help
Compter le nombre de tokens dans la demande d'entrée.POST

FAQ

Jina AI × Elastic

handshake
La marque Jina sera-t-elle préservée ?
keyboard_arrow_down
Oui. Jina est une marque de modèles au sein d'Elastic. On pourrait la comparer à Qwen d'Alibaba, GPT d'OpenAI ou Kimi de Moonshot. L'identité juridique a été transférée à Elastic, ce qui permet à Jina AI de se concentrer exclusivement sur les modèles Search Foundation en tant que marque.
handshake
Sur quoi Jina AI va-t-elle se concentrer à l'avenir ?
keyboard_arrow_down
Des embeddings, des rerankers et des petits modèles pour une recherche optimisée, incluant des modèles multimodaux et de lecture. Notre mission n'est pas encore accomplie et nous n'avons jamais caché notre ambition : devenir un fournisseur de modèles de recherche de premier plan.
handshake
Les offres d'API et de places de marché cloud vont-elles se poursuivre ?
keyboard_arrow_down
Oui. Les API Reader, Embeddings et Reranker continuent d'être développées et maintenues, et les modèles continuent d'être publiés sur les plateformes de cloud. Vous pouvez utiliser nos services API comme auparavant. Seule exception : nous ne pouvons pas fournir nos services aux entités ou pays soumis aux contrôles américains à l'exportation.
handshake
Allez-vous continuer à proposer des modèles à poids libre sur Hugging Face ?
keyboard_arrow_down
Oui. Chez Elastic, Jina continue de repousser les limites des modèles de recherche de base, et nous continuons de publier des modèles à poids ouverts.
handshake
Sous quelle licence ces modèles ouverts seront-ils publiés ?
keyboard_arrow_down
La plupart des modèles actuels sont sous licence CC-BY-NC 4.0 et nous prévoyons que cela reste le cas. Les anciens modèles des générations v1 et v2 sont sous licence Apache-2.0, qui autorise pleinement leur utilisation commerciale. Un modèle, jina-embeddings-v4, est sous la licence de recherche Qwen héritée de son modèle de base : cette licence n'autorise aucune utilisation commerciale et aucune autre licence commerciale ne lui est applicable. La licence applicable est toujours indiquée sur la page du modèle sur Hugging Face ; veuillez donc la consulter plutôt que de la déduire de la génération. Sous licence CC-BY-NC 4.0, les poids peuvent être téléchargés, évalués, comparés et utilisés gratuitement dans le cadre de la recherche, à condition de mentionner la source. En revanche, leur embedding dans un produit commercial nécessite une licence commerciale, qu'Elastic propose sous sa propre référence. Contactez le service commercial d'Elastic pour en obtenir une.
handshake
Allez-vous continuer à publier des articles de recherche ?
keyboard_arrow_down
Oui. Chaque modèle que nous publions est étayé par un article rigoureux, et nous continuons de soumettre nos travaux à des conférences de premier plan telles que ICLR, EMNLP, SIGIR, NeurIPS et ICML.
handshake
Je ne suis pas encore client de Jina ou d'Elastic, mais je souhaite utiliser l'API Reader, les API de modèles ou les images du marché cloud. Que dois-je faire ?
keyboard_arrow_down
Il vous suffit de vous inscrire et de payer via notre site web ou le marketplace cloud approprié, comme auparavant.
handshake
Puis-je acheter une licence commerciale pour les modèles Jina auprès d'Elastic ?
keyboard_arrow_down
Oui. Depuis le 10 août 2026, Elastic commercialise directement des licences pour les modèles Jina, sous sa propre référence. Ces licences permettent d'exécuter les modèles Jina dans votre propre infrastructure autogérée, sur site ou isolée du réseau (air-gapped), et sont disponibles via Elastic (directement), les canaux gouvernementaux et les fournisseurs de services cloud (CSP). Cette offre s'appelle Jina On-Prem. Pour obtenir un devis, contactez Service commercial d'Elastic.
handshake
Qu'est-ce que Jina On-Prem ?
keyboard_arrow_down
Jina On-Prem est une licence commerciale associée à un ensemble de conteneurs Docker autonomes permettant d'exécuter des modèles Jina entièrement au sein de votre infrastructure. Ces conteneurs n'établissent aucune connexion externe : aucun appel à Hugging Face ni à aucun registre de modèles, ni serveur de licences, point de terminaison de télémétrie ou de journalisation. C'est ce qui les rend compatibles avec un réseau isolé (sans accès Internet). Ils couvrent l'ensemble des modèles Jina, notamment les modèles d'embedding, de reranking et de lecture, et exposent les schémas d'API Elastic Inference Service (EIS), OpenAI, Cohere, Voyage AI et Gemini. Vos applications existantes fonctionnent ainsi sans modification de code. Il s'agit d'une référence distincte : elle n'est pas basée sur des unités de ressources élastiques (ERU) et ne nécessite pas l'exécution d'Elasticsearch. Elle est également compatible avec Elasticsearch open source. Elle est disponible à la commande depuis le 10 août 2026. Contactez Elastic Sales pour connaître la disponibilité et les conditions.
handshake
Quel est le prix de Jina On-Prem ?
keyboard_arrow_down
Il s'agit d'une licence annuelle, dont le coût dépend des modèles déployés et de la puissance matérielle utilisée pour l'inférence. La tarification n'est pas basée sur le nombre d'utilisateurs, de nœuds ou de modèles, et il n'y a pas de facturation au token. Un déploiement utilisant uniquement le processeur est facturé de la même manière, en fonction des processeurs dédiés à l'inférence. Pour obtenir un devis, veuillez contacter l'équipe commerciale d'Elastic : Elastic Sales.
handshake
À qui s'adresse Jina On-Prem ?
keyboard_arrow_down
Les organisations qui ne peuvent pas, ou préfèrent ne pas, envoyer de données à un service d'IA cloud. C'est le cas notamment des environnements isolés et hautement sécurisés, du secteur public et de la défense, des industries réglementées comme les services financiers et la santé, des systèmes critiques en termes de latence ou hors ligne, et des équipes qui souhaitent un coût d'inférence fixe et prévisible plutôt qu'une tarification au token. Si votre déploiement correspond à cette description, Elastic Sales peut vous accompagner dans l'étude de votre situation.
handshake
Je suis client Elastic. Puis-je utiliser des modèles Jina dans Elastic Cloud sans rien déployer ?
keyboard_arrow_down
Oui. Les modèles Jina sont disponibles via Elastic Inference Service (EIS), ce qui vous permet de les utiliser pour l'ingestion et la recherche sans avoir à provisionner de nœuds d'apprentissage automatique ni à gérer d'infrastructure GPU. Les modèles généralement disponibles sur EIS incluent : jina-embeddings-v5-text-small, jina-embeddings-v5-text-nano, jina-embeddings-v5-omni-small, jina-embeddings-v5-omni-nano, jina-embeddings-v3, jina-clip-v2, ainsi que les modules de reclassement jina-reranker-v3.5, jina-reranker-v3, jina-reranker-v2-base-multilingual et jina-reranker-m0. Consultez la documentation Elastic pour obtenir la liste des modèles actuels, les régions prises en charge et la version minimale de la pile pour chaque modèle.
handshake
J'ai téléchargé les poids depuis Hugging Face. Ai-je besoin d'une licence pour les utiliser en production ?
keyboard_arrow_down
Cela dépend de la licence du modèle, indiquée sur sa page Hugging Face. La licence Apache 2.0 autorise une utilisation commerciale sans frais. Sous licence CC-BY-NC 4.0, l'évaluation, les tests de performance et la recherche sont gratuits, mais une utilisation commerciale en production nécessite une licence commerciale, comme celle fournie par Jina On-Prem. Une licence de recherche n'autorise aucune utilisation commerciale, et une licence commerciale pour les autres modèles ne s'y applique pas ; par conséquent, un modèle sous l'une de ces licences n'est pas adapté à la production, quel que soit le budget. Notez que ceci concerne les poids : l'utilisation commerciale des API hébergées ou des images de la marketplace cloud officielle ne nécessite aucune licence supplémentaire. Pour en acquérir une, contactez Elastic Sales.
handshake
Je souhaite signer un contrat ou un accord personnalisé concernant les modèles Jina. Que dois-je faire ?
keyboard_arrow_down
Contactez Service commercial d'Elastic. Les licences commerciales, les contrats et le support pour les modèles Jina sont désormais gérés par le processus de vente et de support standard d'Elastic.
handshake
J'achète vos services en tant qu'entité chinoise. Puis-je obtenir une facture en chinois (发票) ?
keyboard_arrow_down
Non applicable aux recharges API en libre-service : celles-ci sont facturées automatiquement par l’entité qui traite le paiement, laquelle ne peut pas émettre de facture en chinois (发票). Pour les achats contractuels, y compris Jina On-Prem, veuillez contacter Service commercial Elastic afin de discuter des entités contractuelles et des modalités de facturation disponibles.
handshake
Je suis client d'Elastic et je souhaite connaître les bonnes pratiques en matière d'embeddings et de rerankers, ou plus généralement, je m'intéresse au développement de Jina AI. Que dois-je faire ?
keyboard_arrow_down
Contactez Elastic Sales, et nous pourrons organiser une session entre vous, l'équipe Jina AI et Elastic.
handshake
Si vous sortez un nouveau modèle pendant la durée de ma licence, sera-t-il inclus ?
keyboard_arrow_down
Les modèles sortis dans la même catégorie pendant la durée de la licence sont inclus : aucun nouvel accord ni achat n’est requis, et votre clé de licence reste inchangée. Celle-ci est valable pour la catégorie et non pour un modèle individuel. Les modèles sous licence interdisant toute utilisation commerciale font exception, puisqu’aucune licence commerciale ne leur est applicable. Pour connaître les détails d’un accord spécifique, veuillez contacter Elastic Sales.
handshake
Quel type d'assistance est inclus avec une licence commerciale, et qui la fournit ?
keyboard_arrow_down
La licence inclut un support de niveau entreprise dans le cadre du contrat de niveau de service standard. Le déploiement reste sous votre responsabilité : vous téléchargez l’image conteneur et l’exécutez dans votre environnement. Le support est disponible en cas de problème d’installation. Le support est assuré selon les procédures standard d’Elastic, comme pour tous les aspects contractuels. Pour connaître les niveaux de service associés à un contrat spécifique, veuillez contacter le service commercial d'Elastic.
handshake
Quels termes relatifs au traitement des données s'appliquent maintenant que Jina fait partie d'Elastic ?
keyboard_arrow_down
Le traitement des données est régi par l'accord de traitement des données d'Elastic et non plus par les anciennes conditions générales de Jina AI GmbH. Ceci a une incidence sur les dossiers d'approvisionnement qui font référence à l'ancien accord ; il est donc important de vérifier tout document rédigé avant l'acquisition. Pour connaître les conditions générales actuelles et les spécificités applicables à votre juridiction, veuillez contacter Elastic Sales.

Comment obtenir ma clé API ?

video_not_supported

Quelle est la limite de débit ?

Limite de débit
Les limites de débit sont suivies de deux manières : RPM (requêtes par minute) et TPM (tokens par minute). Les limites sont appliquées par IP/clé API et sont déclenchées dès que le seuil RPM ou TPM est atteint. Lorsque vous fournissez une clé API dans l'en-tête de la requête, nous suivons les limites de débit par clé plutôt que par adresse IP.
ProduitPoint de terminaison de l'APIDescriptionarrow_upwardsans clé APIkey_offavec clé API gratuitekeyavec clé API payantekeyavec clé API PremiumkeyLatence moyenneComptage de l'utilisation des tokensDemande autorisée
API de Readerhttps://r.jina.aiConvertir l'URL en texte compatible LLM20 RPM500 RPM500 RPMtrending_up5000 RPM7.9sCompter le nombre de tokens dans la réponse de sortie.GET/POST
API de Readerhttps://s.jina.aiRechercher sur le web et convertir les résultats en texte adapté au LLMblock100 RPM100 RPMtrending_up1000 RPM2.5sChaque demande coûte un nombre fixe de tokens, à partir de 10000 tokensGET/POST
API de reclassementhttps://api.jina.ai/v1/rerankClasser les documents par requêteblock100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
dépend de la taille de l'entrée
help
Compter le nombre de tokens dans la demande d'entrée.POST
API embeddingshttps://api.jina.ai/v1/embeddingsConvertir du texte/des images en vecteurs de longueur fixeblock100 RPM & 100,000 TPM500 RPM & 2,000,000 TPMtrending_up5,000 RPM & 50,000,000 TPM
ssid_chart
dépend de la taille de l'entrée
help
Compter le nombre de tokens dans la demande d'entrée.POST

Ai-je besoin d’une licence commerciale ?

Auto-vérification de la licence CC BY-NC

play_arrow
Utilisez-vous notre API hébergée ou nos images officielles sur Azure, AWS ou GCP ?
play_arrow
Oui
Aucune licence supplémentaire n'est requise. L'utilisation commerciale est soumise aux conditions d'utilisation : inscrivez-vous et payez via ce site ou la plateforme cloud.
play_arrow
Non
play_arrow
Exploitez-vous vous-même les poids du modèle, dans un produit ou un service commercial ?
play_arrow
Non
Aucun achat requis. Le téléchargement, l'évaluation, l'analyse comparative et l'utilisation à des fins de recherche sont autorisés conformément à toutes les licences sous lesquelles nous publions, à condition d'en mentionner la source.
play_arrow
Oui
play_arrow
De quelle licence dispose le mannequin ? C’est indiqué sur sa page sur Hugging Face.
play_arrow
Apache-2.0
Apache 2.0 autorise l'utilisation commerciale. Aucun achat requis. Ceci couvre nos anciens modèles de génération v1 et v2.
play_arrow
CC BY-NC 4.0
Vous avez besoin d'une licence commerciale. Depuis le 10 août 2026, Elastic en propose une pour les modèles Jina sous la référence Jina On-Prem. Elle couvre les déploiements autogérés, sur site et isolés du réseau, et ne nécessite pas d'abonnement Elasticsearch.
Si vous êtes déjà client d'Elastic, votre équipe commerciale peut l'ajouter à votre contrat existant.
Contactez le service commercial d'Elastic
play_arrow
Licence de recherche Qwen
La licence de recherche n'autorise pas l'utilisation commerciale, et la licence commerciale de nos autres modèles ne s'applique pas à celui-ci. Aucune option commerciale n'est disponible pour ce modèle, que ce soit en auto-hébergement ou via l'API. Veuillez choisir un modèle sous l'une des deux autres licences.

Autres questions

Questions courantes liées à Reader
Quels sont les coûts associés à l’utilisation de l’API Reader ?
keyboard_arrow_down
L'utilisation de Reader est gratuite pour les bases : ajoutez « https://r.jina.ai/ » au début de votre URL. Fournir une clé API augmente la limite de requêtes et facture des tokens en fonction de la longueur du contenu. Consultez la question 16 pour connaître les limites de requêtes.
Comment fonctionne l'API Reader ?
keyboard_arrow_down
L'API Reader récupère l'URL côté serveur et renvoie un texte propre, compatible avec LLM. Vous choisissez le moteur de récupération avec l'en-tête X-Engine : direct effectue une requête HTTP simple et est le plus rapide ; le moteur par défaut affiche la page dans un navigateur sans interface graphique, ce qui permet l'exécution du JavaScript côté client avant l'extraction ; et cf-browser-rendering est un moteur de rendu expérimental basé sur Cloudflare. Les éléments superflus tels que la navigation, les en-têtes, les pieds de page et les publicités sont supprimés, et le contenu principal est converti en Markdown. Utilisez X-Respond-With pour obtenir d'autres formes de la même page, et X-Target-Selector ou X-Remove-Selector pour conserver ou supprimer des sélecteurs CSS spécifiques.
L'API Reader est-elle open source ?
keyboard_arrow_down
Le code du service Reader est disponible sur le dépôt GitHub de Jina AI. Les modèles utilisés par Reader, notamment ReaderLM-v2 et jina-vlm, sont distribués sous licence CC-BY-NC 4.0. Cette licence n'est pas une licence open source : leur téléchargement et leur utilisation non commerciale sont gratuits, mais leur utilisation commerciale en production requiert une licence commerciale. Elastic commercialise cette licence séparément depuis le 10 août 2026 ; pour en obtenir une, veuillez contacter le service commercial d'Elastic.
Quelle est la latence typique de l’API Reader ?
keyboard_arrow_down
Cela dépend principalement du moteur de rendu et de la page elle-même. Un chargement direct d'une page simple prend généralement quelques centaines de millisecondes, tandis que le moteur de rendu par défaut du navigateur doit charger et exécuter la page avant l'extraction, ce qui prend généralement quelques secondes. Les applications monopages lourdes, les serveurs d'origine lents et les fichiers PDF volumineux nécessitent plus de temps. Si vous accédez à la même URL plusieurs fois dans les 5 minutes, elle est servie depuis le cache et le chargement est quasi instantané ; une URL « chaude » est donc beaucoup plus rapide qu'une URL « froide ».
Pourquoi devrais-je utiliser l'API Reader au lieu de gratter la page moi-même ?
keyboard_arrow_down
Le scraping peut être compliqué et peu fiable, en particulier avec des pages complexes ou dynamiques. L'API Reader fournit une sortie rationalisée et fiable de texte propre et prêt pour LLM.
L'API Reader prend-elle en charge plusieurs langues ?
keyboard_arrow_down
L'API Reader est indépendante de la langue et renvoie le contenu dans la langue d'origine de la page ; elle ne le traduit pas. La négociation du contenu est possible grâce à l'en-tête X-Locale, qui définit les paramètres régionaux du navigateur utilisés lors du rendu. Ainsi, les sites proposant un balisage différent selon les paramètres régionaux peuvent être dirigés vers la version souhaitée.
L'API Reader respecte-t-elle les contrôles d'accès des sites web ?
keyboard_arrow_down
Oui. Reader fonctionne comme un client web standard et respecte les contrôles d'accès des sites web. Si un site web bloque la requête, ce blocage est respecté. Il vous incombe de vous assurer que votre utilisation de Reader est conforme aux conditions d'utilisation des sites que vous consultez et ne porte pas atteinte aux droits de propriété intellectuelle de tiers.
L'API Reader peut-elle extraire le contenu des fichiers PDF ?
keyboard_arrow_down
Oui, l'API Reader peut extraire nativement le contenu des fichiers PDF.
L'API Reader peut-elle traiter le contenu multimédia des pages Web ?
keyboard_arrow_down
Oui, Reader peut ajouter des légendes aux images des pages web grâce à l'en-tête x-with-generated-alt. Cela permet d'ajouter des balises alt descriptives aux images qui en sont dépourvues, permettant aux LLM de comprendre le contenu visuel. La synthèse vidéo est prévue dans les prochaines versions.
Est-il possible d'utiliser l'API Reader sur des fichiers HTML locaux ?
keyboard_arrow_down
Non, l'API Reader ne peut traiter que le contenu provenant d'URL accessibles au public.
L'API Reader met-elle en cache le contenu ?
keyboard_arrow_down
Si vous demandez la même URL dans les 5 minutes, l'API Reader renverra le contenu mis en cache.
Puis-je utiliser l'API Reader pour accéder au contenu derrière une connexion ?
keyboard_arrow_down
Oui, pour les pages acceptant les sessions basées sur les cookies. Transmettez vos cookies de session avec l'en-tête X-Set-Cookie, et le Reader les transmet lors de la récupération de l'URL, en utilisant la même syntaxe <name>=<value> qu'un Set-Cookie classique, éventuellement avec l'option ; domain=. Les requêtes contenant des cookies ne sont jamais mises en cache ; chaque requête est donc effectuée à nouveau. Cette procédure ne vous connecte pas : elle réutilise vos identifiants existants. Il vous incombe donc de les obtenir et de respecter les conditions d'utilisation du site cible. Les flux nécessitant une connexion interactive, l'authentification multifacteur (MFA) ou un token d'accès généré par la page ne sont pas concernés.
Puis-je utiliser l'API Reader pour accéder au PDF sur arXiv ?
keyboard_arrow_down
Oui, vous pouvez soit utiliser le support PDF natif du Reader (https://r.jina.ai/https://arxiv.org/pdf/2310.19923v4), soit utiliser la version HTML d'arXiv (https://r.jina.ai/https://arxiv.org/html/2310.19923v4)
Comment fonctionne la légende d’image dans Reader ?
keyboard_arrow_down
Reader ajoute des légendes à toutes les images de l'URL spécifiée et ajoute Image [idx]: [caption] comme balise alt (si elles n'en ont pas au départ). Cela permet aux LLM en aval d'interagir avec les images dans le raisonnement, la synthèse, etc.
Quelle est l’évolutivité du Reader ? Puis-je l’utiliser en production ?
keyboard_arrow_down
L'API Reader est conçue pour être hautement évolutive. Il est automatiquement mis à l'échelle en fonction du trafic en temps réel et le nombre maximal de requêtes simultanées est désormais d'environ 4 000. Nous le maintenons activement comme l'un des produits principaux de Jina AI. N'hésitez donc pas à l'utiliser en production.
Quelle est la limite de débit de l’API Reader ?
keyboard_arrow_down
Veuillez trouver les dernières informations sur les limites de taux dans le tableau ci-dessous. Notez que nous travaillons activement à l'amélioration de la limite de débit et des performances de l'API Reader, le tableau sera mis à jour en conséquence.
speedLimite de débit
Qu'est-ce que ReaderLM ? Comment puis-je l'utiliser ?
keyboard_arrow_down
ReaderLM-v2 est un modèle de langage léger de 1,54 milliard de paramètres qui convertit le HTML brut en Markdown ou JSON propre et peut extraire des données structurées à l'aide d'un schéma JSON ou d'instructions en langage naturel. Utilisez-le via l'API Reader avec l'en-tête x-respond-with: readerlm-v2, ou déployez-le depuis les places de marché AWS, Azure ou GCP. Pour les documents riches en images ou numérisés, jina-vlm est notre modèle de lecture basé sur la vision et le langage, doté de 2,4 milliards de paramètres.
launchAWS SageMakerlaunchGoogle CloudlaunchMicrosoft Azure
Comment extraire des données structurées à partir de pages web ?
keyboard_arrow_down
Utilisez l'en-tête x-json-schema avec une définition de schéma JSON, ou l'en-tête x-instruction avec des instructions en langage naturel. Ces deux fonctionnalités sont compatibles avec ReaderLM-v2 pour extraire des champs spécifiques (prix, titres, dates, etc.) de n'importe quelle page web et les convertir au format JSON structuré.
Le Reader contourne-t-il activement la protection anti-robots du site web ?
keyboard_arrow_down
Non. Reader ne cherche pas à contourner activement les mécanismes de défense des sites web, les systèmes anti-robots ou les contrôles d'accès. Si un site web détecte notre service comme un robot et bloque la requête, cette décision est respectée. Nous fonctionnons comme un client web standard et n'utilisons aucune technique visant à échapper aux systèmes de détection. Il vous incombe de veiller à ce que votre utilisation de Reader respecte les droits de propriété intellectuelle des tiers et les conditions d'utilisation des sites que vous consultez.
Le passage d'une clé API gratuite à une clé payante me donnera-t-il accès à davantage de sites web ?
keyboard_arrow_down
Non. Le passage d'une version gratuite à une clé API payante ne donne pas accès à des sites web supplémentaires et ne permet pas de contourner les restrictions des sites. La différence entre les versions réside principalement dans les limites de débit et l'optimisation des performances. Une clé API payante offre un débit de requêtes plus élevé et un traitement plus rapide, mais elle ne permet pas d'accéder aux sites web qui bloquent notre service.
Puis-je exécuter Reader au sein de ma propre infrastructure ?
keyboard_arrow_down
Oui. Les modèles de lecture sont distribués sous forme de conteneurs Docker hors ligne autonomes, conformément à la licence commerciale Jina On-Prem qu'Elastic commercialise depuis le 10 août 2026. Cette solution est idéale pour les environnements isolés et protégés par pare-feu, où les conteneurs n'établissent aucune connexion sortante. Veuillez noter que la récupération de pages web publiques nécessite toujours un accès réseau à ces pages ; l'intérêt de l'exécution sur site réside dans l'exécution locale des modèles d'extraction. Contactez le service commercial d'Elastic pour obtenir un devis.
Questions courantes liées aux embeddings
Comment les modèles d'embedding Jina ont-ils été entraînés ?
keyboard_arrow_down
Pour des informations détaillées sur nos processus d'entraînement, nos sources de données et nos évaluations, veuillez consulter les rapports techniques sur arXiv. Les modèles de texte jina-embeddings-v5 sont entraînés en deux étapes : une distillation des embeddings à partir d'un modèle enseignant plus large, suivie d'un entraînement des adaptateurs LoRA spécifiques à la tâche sur les poids du réseau de base figés. Les variantes multimodales v5-omni ajoutent une troisième étape qui entraîne uniquement les projecteurs intermodaux, en laissant le réseau de base et les adaptateurs de texte figés.
launcharXiv
Quels sont vos modèles d'embedding multimodaux ?
keyboard_arrow_down
Nos modèles multimodaux actuels sont jina-embeddings-v5-omni-small (environ 1,74 milliard de paramètres, 1 024 dimensions, 32 000 contextes) et jina-embeddings-v5-omni-nano (environ 1,04 milliard de paramètres, 768 dimensions, 8 000 contextes). Ils acceptent le texte, les images, l’audio, la vidéo et les PDF dans un espace vectoriel partagé, ce qui permet d’indexer dans une modalité et d’effectuer des requêtes dans une autre sans réindexation. Leur rendu en mode texte seul est identique à celui de jina-embeddings-v5-text-small et jina-embeddings-v5-text-nano respectivement, ce qui signifie qu’il est possible d’ajouter des données multimodales à un index de texte existant sans réembedding. jina-clip-v2 (865 millions de paramètres) reste disponible comme option plus légère pour le traitement du texte et des images.
launcharXiv
Quelles langues vos modèles prennent-ils en charge ?
keyboard_arrow_down
Tous les modèles publiés depuis 2024 sont multilingues. Les modèles jina-embeddings-v5-text-small et v5-omni reposent sur une architecture Qwen3 offrant une large couverture multilingue ; jina-embeddings-v5-text-nano est basé sur EuroBERT-210M et couvre 15 langues européennes et internationales majeures, dont l’anglais, le français, l’allemand, l’espagnol, le chinois, le japonais, l’arabe et l’hindi. Les modèles jina-embeddings-v3 et jina-clip-v2 prennent en charge 89 langues. Pour consulter les résultats des tests de performance par langue, reportez-vous aux résultats MMTEB dans le rapport technique de chaque modèle.
launcharXiv
Quelle est la longueur maximale du contexte pour une entrée unique ?
keyboard_arrow_down
La longueur du contexte varie selon le modèle : jina-embeddings-v5-text-small et jina-embeddings-v5-omni-small prennent en charge jusqu’à 32 768 tokens, tandis que jina-embeddings-v5-text-nano et jina-embeddings-v5-omni-nano en prennent en charge 8 192. Les modèles jina-embeddings-v4 et jina-code-embeddings prennent en charge 32 768 tokens ; jina-embeddings-v3, jina-clip-v2 et jina-colbert-v2 en prennent en charge 8 192. Les entrées dépassant cette limite renvoient une erreur, sauf si vous définissez truncate: true.
Quel est le nombre maximal d'entrées que je peux inclure dans une seule requête ?
keyboard_arrow_down
Il n'y a pas de limite stricte au nombre d'éléments par requête. L'API regroupe les entrées en interne par nombre de tokens pour une utilisation optimale du GPU ; vous pouvez donc envoyer autant de textes ou d'images que nécessaire en une seule requête. Les fichiers PDF font exception : envoyez-en un par requête.
Comment envoyer des images, de l'audio, de la vidéo ou des PDF aux modèles multimodaux ?
keyboard_arrow_down
Transmettez un objet typé dans le tableau input à l'aide d'une clé image, audio, video ou pdf, dont la valeur est soit une URL publique, soit des octets encodés en base64. Le modèle achemine chaque modalité vers l'encodeur approprié, et vous pouvez combiner librement les modalités au sein d'un même lot. Les formats audio pris en charge sont WAV, MP3, FLAC, OGG, M4A et Opus ; la vidéo est traitée en 32 images échantillonnées uniformément. Les fichiers PDF doivent être envoyés un par requête.
Comment les représentations vectorielles de Jina se comparent-elles aux derniers modèles OpenAI, Cohere et Voyage ?
keyboard_arrow_down
Le modèle jina-embeddings-v5-text-small (677 millions de paramètres) est le plus performant avec moins d'un milliard de paramètres sur MMTEB, avec un score moyen de 67,0 au niveau de la tâche et de 71,7 en moyenne sur English MTEB. Le modèle jina-embeddings-v5-text-nano (239 millions de paramètres) obtient un score de 65,5 sur MMTEB, surpassant tous les modèles évalués avec moins de 500 millions de paramètres. Notre objectif est d'optimiser les performances par paramètre plutôt que de maximiser la taille des modèles ; ces derniers sont donc plus économiques à déployer que la plupart des alternatives offrant une qualité de recherche comparable, voire supérieure. Tous les modèles v5 prennent en charge l'apprentissage par représentation Matryoshka, ce qui permet de réduire la dimensionnalité à 32 sans réentraînement.
Dans quelle mesure la transition entre Text-Embedding-3-Large d'OpenAI et votre solution est-elle transparente ?
keyboard_arrow_down
La transition est simple : notre point de terminaison API correspond aux schémas JSON d'entrée et de sortie du modèle text-embedding-3-large d'OpenAI. Ainsi, dans la plupart des bases de code, il suffit de modifier l'URL de base, la clé API et le nom du modèle. Il en va de même pour les conteneurs Jina On-Prem, qui exposent également les schémas d'Elastic Inference Service (EIS), de Cohere, de Voyage AI et de Gemini. Les modèles Jina s'intègrent donc facilement dans le code existant. Attention : les embeddings de différentes familles de modèles ne sont pas comparables. Il est donc nécessaire de réintégrer votre corpus plutôt que de mélanger les vecteurs de deux fournisseurs dans un seul index. Pour les conteneurs On-Prem, contactez le service commercial d'Elastic.
Comment les tokens sont-ils calculés pour les images et autres entrées non textuelles ?
keyboard_arrow_down
Le texte est comptabilisé de manière standard. Les entrées non textuelles sont converties en tokens par l'encodeur approprié, et le coût dépend fortement du modèle utilisé. Il est donc conseillé de réaliser des mesures avec vos propres données d'entrée plutôt que de faire des suppositions. À titre indicatif, une image de 600 x 600 pixels coûte approximativement : • jina-embeddings-v5-omni-small : ~363 tokens • jina-embeddings-v5-omni-nano : ~362 tokens • jina-embeddings-v4 : ~4 840 tokens • jina-clip-v2 : ~16 000 tokens Les modèles v5-omni sont de cent à cent fois moins chers par image que les modèles précédents. Chaque réponse inclut un objet usage avec le nombre exact de tokens pour cette requête, y compris une ventilation image_tokens pour les entrées multimodales, afin que vous puissiez vérifier le coût par appel.
Fournissez-vous des modèles pour intégrer des images, de l'audio ou de la vidéo ?
keyboard_arrow_down
Oui. Les modules jina-embeddings-v5-omni-small et jina-embeddings-v5-omni-nano intègrent du texte, des images, de l'audio, de la vidéo et des PDF dans un seul espace vectoriel partagé. Les modules jina-embeddings-v4 et jina-clip-v2 gèrent le texte et les images.
Les modèles d'embedding Jina peuvent-ils être affinés sur des données privées ou d'entreprise ?
keyboard_arrow_down
Deux options s'offrent à vous. La première, en libre-service, utilise l'API de réglage fin. Celle-ci génère des données d'entraînement synthétiques à partir d'une description de votre domaine et vous fournit un modèle optimisé, sans que vous ayez à constituer un jeu de données étiqueté. Pour un réglage fin sur des données propriétaires faisant l'objet d'un accord commercial, sur une infrastructure dédiée ou sur un modèle ne figurant pas dans le sélecteur de modèles de base, veuillez contacter Elastic Sales. Ce type de prestation est défini et contractualisé par Elastic.
Contact
Les modèles peuvent-ils être hébergés de manière privée, sur ma propre infrastructure ou dans mon propre compte cloud ?
keyboard_arrow_down
Oui, de deux manières. Les modèles Jina sont disponibles sur les places de marché AWS, Azure et GCP, ce qui vous permet de les déployer dans votre propre compte cloud. Pour les infrastructures autogérées, sur site ou isolées du réseau, Elastic propose une licence commerciale appelée Jina On-Prem, disponible depuis le 10 août 2026. Cette licence fournit les modèles sous forme de conteneurs Docker entièrement hors ligne, sans appels externes ni serveur de licences. Pour obtenir un devis pour l'une ou l'autre option, contactez le service commercial d'Elastic.
launchAWS SageMakerlaunchGoogle CloudlaunchMicrosoft Azure
Qu’est-ce que le paramètre « task » et quand dois-je l’utiliser ?
keyboard_arrow_down
Le paramètre task sélectionne un adaptateur LoRA spécifique à la tâche pour des performances optimales. Utilisez retrieval.query pour les requêtes de recherche, retrieval.passage pour les documents recherchés, text-matching pour la similarité symétrique (détection de doublons ou de paraphrases), classification pour la catégorisation et separation pour le regroupement. La recherche étant asymétrique, utiliser le mauvais côté de la paire requête/passage dégrade sensiblement les résultats. Ce paramètre est compatible avec jina-embeddings-v5, jina-embeddings-v4 et jina-embeddings-v3.
Qu’est-ce que la récupération late-interaction et quels modèles la prennent en charge ?
keyboard_arrow_down
Le late-interaction conserve les vecteurs au niveau des tokens au lieu de fusionner un document en un seul vecteur, préservant ainsi les détails fins au prix d'un index plus volumineux. jina-embeddings-v4 prend en charge les sorties denses (vecteur unique) et late-interaction (vecteurs multiples) via le paramètre output_type, tandis que jina-colbert-v2 est un modèle dédié au late-interaction. Pour la plupart des pipelines de recherche, un modèle dense v5 suivi d'un réordonnanceur offre un meilleur compromis précision/coût.
Qu’est-ce que le découpage tardif et quand dois-je l’utiliser ?
keyboard_arrow_down
Le découpage tardif intègre d'abord l'intégralité du document à l'aide d'un modèle de contexte long, puis dérive les représentations des segments à partir des tokens. Contrairement au découpage naïf, qui intègre chaque segment isolément, le découpage tardif préserve le contexte inter-segments, ce qui améliore la qualité de la recherche dans les pipelines RAG où un segment fait référence à un élément défini plus haut dans le document. Activez-le avec le paramètre late_chunking.
Pourquoi l'API impose-t-elle une longueur de contexte différente de celle prise en charge par le modèle ?
keyboard_arrow_down
Certains modèles sont conçus pour gérer un contexte plus long que celui accepté par l'API hébergée. Les séquences très longues consomment une quantité importante de mémoire GPU ; nous optimisons donc la configuration de diffusion afin d'équilibrer débit, latence et coût pour la plupart des cas d'utilisation. Si vous avez besoin de la longueur complète du contexte architectural, exécutez le modèle vous-même : contactez Elastic Sales pour un déploiement autogéré.
Pourquoi jina-embeddings-v4 est-il gratuit, et pourquoi est-il lent ?
keyboard_arrow_down
Le module jina-embeddings-v4 est basé sur le modèle Qwen2-VL et distribué sous licence de recherche Qwen, qui autorise uniquement la recherche et une utilisation non commerciale. Par conséquent, nous ne pouvons pas le commercialiser et le proposons gratuitement via l'API. Ce modèle comporte 3,8 milliards de paramètres, ce qui le rend intrinsèquement plus lent par requête. De plus, son débit est limité afin de maîtriser les coûts d'infrastructure. Il n'est pas adapté aux charges de travail en production et, pour la même raison, n'est pas proposé via Elastic Inference Service ni dans le cadre de Jina On-Prem. Pour une utilisation en production, privilégiez la famille jina-embeddings-v5 : plus rapide et plus performante en termes de performances de recherche, elle peut être commercialisée via Elastic Sales.
Quelles sont les limites de débit de l'API Embeddings ?
keyboard_arrow_down
Les limites de débit dépendent du type de votre clé API :

Gratuit : 100 RPM, 100 000 TPM
Payant : 500 RPM, 2 millions TPM
Premium : 5 000 RPM, 50 millions TPM

Une limite supplémentaire de 10 000 requêtes par adresse IP et par période de 60 secondes est appliquée afin de prévenir les abus. Les limites sont appliquées par clé et comptabilisées sur une période de 60 secondes, ce qui permet d’aplanir les pics de trafic plutôt que de les mettre en file d’attente. Une requête dépassant la limite renvoie une erreur HTTP 429 et doit être relancée avec un délai exponentiel. Si vous avez besoin de limites supérieures à celles du niveau Premium, ou d’une capacité dédiée sans aucune limite partagée, veuillez contacter Elastic Sales.
Quel modèle d'embedding dois-je choisir ?
keyboard_arrow_down
Commencez par jina-embeddings-v5-text-small pour la recherche de texte : c’est le modèle le plus performant pour les requêtes inférieures à 1 milliard de mots et il gère jusqu’à 32 000 éléments de contexte. Passez à jina-embeddings-v5-text-nano lorsque la latence, le coût ou les performances du matériel périphérique priment sur la précision maximale. Utilisez jina-embeddings-v5-omni-small ou v5-omni-nano pour les images, les fichiers audio, vidéo ou PDF ; leur rendu textuel est identique à celui du modèle de texte correspondant, ce qui vous permet d’ajouter des modalités à un index existant sans réembedding. Utilisez jina-code-embeddings-0.5b ou jina-code-embeddings-1.5b pour le code source. Au sein d’une même famille, la version la plus récente est préférable.
Quelles sont les limites de taille des fichiers image et PDF ?
keyboard_arrow_down
La taille maximale des fichiers est de 5 Mo pour les images et de 8 Mo pour les PDF. Les fichiers plus volumineux seront rejetés et un message d'erreur s'affichera.
Questions courantes liées au reranker
Combien coûte l’API Reranker ?
keyboard_arrow_down
La tarification de l'API Reranker suit la même structure de tokens que l'API Embeddings, et les tokens sont partagés entre toutes les API Jina utilisant la même clé. Les nouvelles clés API incluent des tokens gratuits pour démarrer ; ensuite, des packs de tokens sont disponibles à l'achat. Consultez la section Tarification pour plus de détails.
Quelles sont les différences entre les rerankers de Jina ?
keyboard_arrow_down
jina-reranker-v3.5 est notre produit phare actuel : un réordonnanceur multilingue listwise de 0,6 milliard de paramètres avec un contexte de 131 000 tokens, remplaçant directement jina-reranker-v3. Il améliore la version 3 sur tous les axes mesurés, avec les gains les plus importants en matière de données structurées et de recherche juridique, et est 1,22 à 1,56 fois plus rapide. jina-reranker-v3 reste disponible. jina-reranker-m0 est le réordonnanceur multimodal pour le classement des documents visuels. jina-reranker-v2-base-multilingual est un encodeur croisé plus léger prenant en charge plus de 100 langues, utile lorsque vous avez besoin d’un modèle non dérivé de Qwen. jina-colbert-v2 utilise le late-interaction dans 89 langues.
Comment les reclasseurs Jina obtiennent-ils leur licence ?
keyboard_arrow_down
Les modules jina-reranker-v3.5, jina-reranker-v3, jina-reranker-m0, jina-reranker-v2-base-multilingual et jina-colbert-v2 sont distribués sous licence CC-BY-NC 4.0. Vous êtes libre de les utiliser, de les partager et de les adapter à des fins non commerciales. Une utilisation commerciale en production nécessite une licence commerciale, qu'Elastic commercialise depuis le 10 août 2026 sous le nom de Jina On-Prem. Contactez le service commercial d'Elastic pour obtenir un devis. Les anciens modèles jina-reranker-v1-* restent sous licence Apache 2.0.
Les rerankers prennent-ils en charge plusieurs langues ?
keyboard_arrow_down
Oui, tous les outils de réordonnancement actuels sont multilingues. jina-reranker-v3.5 améliore la version 3 pour MIRACL et la recherche multilingue en général. jina-reranker-v3 et jina-reranker-v2-base-multilingual prennent en charge plus de 100 langues, jina-reranker-m0 gère le classement visuel multilingue des documents et jina-colbert-v2 prend en charge 89 langues.
Quelle est la longueur maximale du contexte pour chaque reranker ?
keyboard_arrow_down
La longueur du contexte varie selon le modèle :

jina-reranker-v3.5 : 131 072 tokens (requête et tous les documents combinés) avec troncature automatique
jina-reranker-v3 : 131 072 tokens avec troncature automatique
jina-reranker-m0 : 10 000 tokens
jina-reranker-v2-base-multilingual : 1 024 tokens, avec découpage automatique pour les documents longs
jina-colbert-v2 : 8 192 tokens

Pour les réorganisateurs v1 et v2, les requêtes sont tronquées automatiquement et les documents longs sont découpés en segments avec un regroupement maximal entre les segments.
Existe-t-il une limite au nombre de documents que je peux réorganiser par requête ?
keyboard_arrow_down
Il n'y a pas de limite stricte au nombre de documents par requête. À l'instar de notre API Embeddings, l'API Reranker regroupe les entrées en interne par nombre de tokens afin d'optimiser l'utilisation du GPU. Vous pouvez envoyer autant de documents que nécessaire en une seule requête.
À quelle latence puis-je m'attendre lors du reclassement de 100 documents ?
keyboard_arrow_down
La latence varie de 100 millisecondes à 7 secondes, en fonction en grande partie de la longueur des documents et de la requête. Par exemple, le reclassement de 100 documents de 256 tokens chacun avec une requête de 64 tokens prend environ 150 millisecondes. L'augmentation de la longueur du document à 4 096 tokens augmente le temps à 3,5 secondes. Si la longueur de la requête est augmentée à 512 tokens, le temps augmente encore à 7 secondes.
Vous trouverez ci-dessous le coût en temps nécessaire au reclassement d'une requête et de 100 documents en millisecondes :
Nombre de tokens dans chaque document
Nombre de tokens dans la requête256512102420484096
64156323136621073571
128194369137721233598
256273475139721554299
5124681385211435367068
Est-il possible d'héberger les outils de reclassement en mode privé, sur ma propre infrastructure ou dans mon propre compte cloud ?
keyboard_arrow_down
Oui. Les outils de réévaluation sont disponibles sur les places de marché AWS, Azure et GCP pour un déploiement dans votre propre compte cloud. Pour les infrastructures autogérées, sur site ou isolées du réseau, Elastic propose une licence commerciale (Jina On-Prem) qui fournit les modèles sous forme de conteneurs Docker entièrement hors ligne. Contactez le service commercial d'Elastic pour obtenir un devis.
launchAWS SageMakerlaunchGoogle CloudlaunchMicrosoft Azure
Proposez-vous un outil de reclassement optimisé sur des données spécifiques à un domaine ?
keyboard_arrow_down
Avant de commander un réglage fin, essayez jina-reranker-v3.5 : entraîné avec l'auto-distillation spécifiquement pour une robustesse accrue au sein du domaine, il affiche des gains significatifs en matière de recherche de données juridiques et structurées par rapport à la version 3. Un outil de reranking prêt à l'emploi bien choisi, associé à un meilleur découpage des données, permet généralement de combler davantage l'écart qu'un réglage fin, et son test est gratuit. Si les résultats ne sont toujours pas à la hauteur de vos données, un outil de reranking spécifique à votre domaine est une solution personnalisée : contactez Elastic Sales pour définir le périmètre de votre projet.
Contact
Quelle est la taille minimale de l'image pour les documents ?
keyboard_arrow_down
La taille d'image minimale acceptable pour le modèle jina-reranker-m0 est de 28x28 pixels.
Qu’est-ce que le réordonnancement listwise et en quoi diffère-t-il du réordonnancement par points ?
keyboard_arrow_down
Les modules jina-reranker-v3 et jina-reranker-v3.5 utilisent une architecture listwise : la requête et tous les candidats partagent une même fenêtre de contexte et sont évalués en une seule passe, permettant ainsi au modèle de comparer les documents entre eux. Les systèmes de réévaluation ponctuelle traditionnels, comme jina-reranker-v2-base-multilingual, évaluent chaque document indépendamment de la requête. L'évaluation listwise est plus précise car la pertinence est souvent relative aux autres éléments de l'ensemble des candidats.
Pourquoi l'API impose-t-elle une longueur de contexte différente de celle prise en charge par le modèle ?
keyboard_arrow_down
Certains systèmes de réordonnancement sont conçus pour gérer un contexte plus long que celui accepté par l'API hébergée. Les séquences très longues consomment une quantité importante de mémoire GPU ; nous optimisons donc la configuration de diffusion afin d'équilibrer débit, latence et coût pour la plupart des cas d'utilisation. Si vous avez besoin de la longueur complète du contexte architectural, exécutez le modèle sur votre propre infrastructure et contactez Service commercial d'Elastic pour obtenir une licence commerciale.
Quelles sont les limites de débit de l'API Reranker ?
keyboard_arrow_down
Les limites de débit dépendent du type de votre clé API :

Gratuite : 100 RPM, 100 000 TPM
Payante : 500 RPM, 2 millions TPM
Premium : 5 000 RPM, 50 millions TPM

Il existe également une limite de 10 000 requêtes par adresse IP et par période de 60 secondes. Ces mêmes limites s’appliquent aux API Embeddings et Reranker, et les tokens sont partagés entre toutes les API Jina utilisant la même clé.
Quel outil de reclassement dois-je choisir ?
keyboard_arrow_down
Utilisez jina-reranker-v3.5 pour le traitement de texte. Ce module remplace directement jina-reranker-v3 : le schéma de requête restant inchangé, la migration se limite donc au remplacement de la chaîne de modèle. Utilisez jina-reranker-m0 lorsque vos candidats sont des images ou des documents riches en contenu visuel. Utilisez jina-reranker-v2-base-multilingual si vous avez besoin d'un modèle plus léger ou d'un modèle non basé sur Qwen.
Questions courantes liées à l'API
code
Puis-je utiliser la même clé API pour toutes les API Jina ?
keyboard_arrow_down
Oui. Une seule clé API est valable pour tous les produits de la plateforme de recherche Jina AI, y compris les API Reader, Embeddings, Reranker, Classifier et Segmenter, avec des tokens partagés entre eux.
code
Puis-je surveiller l’utilisation des tokens de ma clé API ?
keyboard_arrow_down
Oui, l'utilisation des tokens peut être surveillée dans l'onglet « Clé API et facturation » en saisissant votre clé API, ce qui vous permet d'afficher l'historique d'utilisation récent et les tokens restants. Si vous êtes connecté au tableau de bord de l'API, ces détails peuvent également être consultés dans l'onglet « Gérer la clé API ».
code
Que dois-je faire si j'oublie ma clé API ?
keyboard_arrow_down
Si vous avez égaré une clé rechargée et souhaitez la récupérer, veuillez contacter le support AT jina.ai avec votre adresse e-mail enregistrée pour obtenir de l'aide. Il est recommandé de vous connecter pour conserver votre clé API en toute sécurité et facilement accessible.
Contact
code
Les clés API expirent-elles ?
keyboard_arrow_down
Non, nos clés API n'ont pas de date d'expiration. Si une clé est compromise, révoquez-la vous-même depuis le tableau de bord de gestion des clés API. La révocation est immédiate. Pour éviter toute interruption de service, émettez d'abord une clé de remplacement. Le solde de tokens restant est conservé sur votre compte et non associé à la clé révoquée. Si vous ne pouvez pas accéder au tableau de bord ou si vous pensez que votre compte est compromis, contactez le support Elastic.
Contact
code
Puis-je transférer des tokens entre des clés API ?
keyboard_arrow_down
Oui, vous pouvez transférer des tokens d'une clé premium vers une autre. Après vous être connecté à votre compte sur le tableau de bord de gestion des clés API, utilisez les paramètres de la clé que vous souhaitez transférer pour déplacer tous les tokens payants restants.
code
Puis-je révoquer ma clé API ?
keyboard_arrow_down
Oui, vous pouvez révoquer votre clé API si vous pensez qu'elle a été compromise. La révocation d'une clé la désactivera immédiatement pour tous les utilisateurs qui l'ont stockée, et tout le solde restant et les propriétés associées seront définitivement inutilisables. Si la clé est une clé premium, vous avez la possibilité de transférer le solde restant payé vers une autre clé avant la révocation. Notez que cette action ne peut pas être annulée. Pour révoquer une clé, accédez aux paramètres de clé dans le tableau de bord de gestion des clés API.
code
Pourquoi la première demande de certains modèles est-elle lente ?
keyboard_arrow_down
Cela est dû au fait que notre architecture sans serveur décharge certains modèles pendant les périodes de faible utilisation. La requête initiale active ou « réchauffe » le modèle, ce qui peut prendre quelques secondes. Après cette activation initiale, les requêtes suivantes sont traitées beaucoup plus rapidement.
code
Mes données API sont-elles utilisées pour entraîner vos modèles ?
keyboard_arrow_down
Non. Nous n'utilisons jamais vos requêtes API, entrées ou sorties pour entraîner nos modèles d'embedding, de reranker ou tout autre modèle. Vos données vous appartiennent.
code
Quelles sont les limites de débit des API Jina ?
keyboard_arrow_down
Des limites de débit s'appliquent par clé API :

Gratuit : 100 RPM, 100 000 TPM
Payant : 500 RPM, 2 millions TPM
Premium : 5 000 RPM, 50 millions TPM

Une limite de 10 000 requêtes par 60 secondes est également appliquée par adresse IP. Les limites varient selon le point de terminaison ; consultez le tableau des limites de débit ci-dessus pour connaître les valeurs par point de terminaison.
code
Existe-t-il des limites de taille de lot pour les API ?
keyboard_arrow_down
Il n'y a aucune limite de taille de lot pour les API Embeddings et Reranker. Vous pouvez envoyer autant d'éléments ou de documents que nécessaire par requête. Les deux API traitent les entrées par lots en interne, en fonction du nombre de tokens, pour une utilisation optimale du GPU.
code
Les API Jina sont-elles la même chose que les modèles Jina au sein d'Elastic ?
keyboard_arrow_down
Non, il s'agit de trois solutions distinctes. Les API Jina disponibles sur ce site sont en libre-service et fonctionnent avec un paiement à l'utilisation via une clé API Jina. Elastic Inference Service (EIS) exécute les modèles Jina au sein d'Elastic Cloud et est facturé via votre abonnement Elastic, sans aucune infrastructure à gérer de votre part. Jina On-Prem est une licence commerciale, vendue par Elastic sous sa propre référence depuis le 10 août 2026, permettant d'exécuter les modèles dans votre propre infrastructure autogérée, sur site ou isolée du réseau. Pour les solutions EIS et On-Prem, veuillez contacter le service commercial d'Elastic.
Questions courantes liées à la facturation
attach_money
La facturation est-elle basée sur le nombre de phrases ou de demandes ?
keyboard_arrow_down
Notre modèle de tarification est basé sur le nombre total de tokens traités, ce qui donne aux utilisateurs la possibilité d'attribuer ces tokens à un nombre illimité de phrases, offrant ainsi une solution rentable pour diverses exigences d'analyse de texte.
attach_money
Existe-t-il un essai gratuit disponible pour les nouveaux utilisateurs ?
keyboard_arrow_down
Oui. Les nouveaux utilisateurs reçoivent une clé API générée automatiquement ainsi que des tokens gratuits utilisables avec tous nos modèles. Une fois ces tokens gratuits épuisés, vous pouvez en acheter d'autres pour cette clé dans l'onglet « Acheter des tokens ».
attach_money
Les tokens sont-ils facturés pour les demandes ayant échoué ?
keyboard_arrow_down
Non, les tokens ne sont pas déduits pour les demandes ayant échoué.
attach_money
Quels moyens de paiement sont acceptés ?
keyboard_arrow_down
Les paiements sont traités via Stripe, prenant en charge diverses méthodes de paiement, notamment les cartes de crédit, Google Pay et PayPal, pour votre commodité.
attach_money
La facturation est-elle disponible pour les achats de tokens ?
keyboard_arrow_down
Pour les achats de tokens en libre-service, Stripe envoie une facture à l'adresse e-mail associée à votre compte Stripe au moment de l'achat. Si vous avez besoin d'un bon de commande, d'un contrat négocié, de documents d'approvisionnement ou d'une facturation consolidée, traités par Elastic et non par Stripe : contactez le service commercial d'Elastic.
attach_money
Comment puis-je acheter une licence commerciale plutôt que des tokens API ?
keyboard_arrow_down
L'achat de tokens sur ce site vous permet d'utiliser les API Jina hébergées. Il ne vous autorise pas à exécuter les poids du modèle sur votre propre infrastructure. Pour cela, Elastic propose une licence commerciale distincte depuis le 10 août 2026, facturée annuellement et non par token. Contactez le service commercial d'Elastic pour obtenir un devis.
attach_money
Puis-je payer par facture ou bon de commande plutôt que par carte ?
keyboard_arrow_down
Les achats de tokens en libre-service sont traités par Stripe et facturés automatiquement à l'adresse e-mail associée à votre compte Stripe. Pour les commandes, les processus d'approvisionnement ou les volumes supérieurs à la capacité de recharge en libre-service, veuillez contacter Elastic Sales.
attach_money
J'ai payé, mais mon solde ou ma limite de débit n'a pas changé. Que dois-je vérifier ?
keyboard_arrow_down
Le solde et les limites de débit sont liés à une clé API, et non au compte. Par conséquent, vérifiez d'abord la clé elle-même, et non la page du compte : saisissez-la dans l'onglet « Clé API et facturation » et vérifiez le solde et le niveau. Si le compte possède plusieurs clés, les tokens sont associés à la clé rechargée, qui peut différer de celle utilisée par votre application. La mise à jour du niveau peut prendre un peu de temps après le paiement. Si le solde affiché est correct mais que la limite reste celle du niveau précédent, contactez l'assistance.
attach_money
Comment puis-je annuler, arrêter le rechargement automatique ou supprimer un mode de paiement enregistré ?
keyboard_arrow_down
La facturation en libre-service est gérée depuis le portail client, accessible via l'onglet « Clé API et facturation ». Vous pouvez y désactiver le rechargement automatique et supprimer les moyens de paiement enregistrés. La désactivation du rechargement automatique empêche les prélèvements futurs, mais le solde déjà utilisé reste disponible. Si vous souhaitez également supprimer votre compte et ses données, ou demander un remboursement, veuillez adresser votre demande au support. La suppression de compte est traitée manuellement et prend quelques jours ouvrables. Vous recevrez une confirmation écrite une fois la suppression effectuée.
Langue / thème actuel
Search Foundation
Reader
Embeddings
Reclasseur
Obtenir la clé API Jina
Limite de débit
À propos de nous
Actualités
Télécharger le logo Jina
open_in_new
Télécharger le logo Elastic
open_in_new
Statut de l'API
Elastic © 2026.SécuritéTermes et conditionsConfidentialitéGérer les cookiesNe vendez ni ne partagez mes informations personnelles
Ce site web et l'ensemble de son contenu, de ses logiciels, produits et services sont destinés exclusivement à un usage professionnel. Aucun usage à des fins de consommation n'est prévu.